![]()
![]()
中國(guó)半導(dǎo)體這些年,走過(guò)了一條很長(zhǎng)、很曲折的路。
今日,一條新的路被點(diǎn)亮。
7月13日,上海東郊賓館紫金廳,東方算芯召開(kāi)軟件定義算力芯片、系統(tǒng)及路線圖發(fā)布會(huì),創(chuàng)始人、董事長(zhǎng)兼CEO魏少軍帶著軟件定義近存計(jì)算3D芯片DF1000走上臺(tái)前。現(xiàn)場(chǎng)高朋滿座,來(lái)自政屆的上海國(guó)有資本投資有限公司黨委書記、董事長(zhǎng)袁國(guó)華;上海市經(jīng)濟(jì)和信息化委員會(huì)副主任俞文杰;上海市委組織部部務(wù)委員、上海市人才工作局副局長(zhǎng)譚樸珍;上海市浦東新區(qū)人民政府黨組成員、副區(qū)長(zhǎng)李慧;上海市科學(xué)技術(shù)委員會(huì)信息技術(shù)處副處長(zhǎng)于金旭;上海市浦東新區(qū)科技和經(jīng)濟(jì)委員會(huì)黨組書記、主任汪瀟;上海市張江科學(xué)城建設(shè)管理辦公室黨組書記、主任肖健。學(xué)術(shù)界代表有香港工程科學(xué)院院士、東京大學(xué)工學(xué)部院士、香港科技大學(xué)副校長(zhǎng)鄭光廷;歐洲科學(xué)院院士、北京超弦存儲(chǔ)器研究院執(zhí)行院長(zhǎng)趙超。產(chǎn)業(yè)界代表上海儀電集團(tuán)有限公司副總裁劉山泉;上海兆芯集成電路股份有限公司總經(jīng)理兼總工程師王惟林,芯原微電子股份有限公司董事長(zhǎng)戴偉民。
魏少軍在中國(guó)集成電路產(chǎn)業(yè)圈并不是一個(gè)陌生名字。作為清華大學(xué)長(zhǎng)聘教授、國(guó)際歐亞科學(xué)院院士、國(guó)家集成電路產(chǎn)業(yè)發(fā)展咨詢委員會(huì)委員,他長(zhǎng)期從事超大規(guī)模集成電路設(shè)計(jì)方法學(xué)、可重構(gòu)計(jì)算架構(gòu)及通信專用集成電路技術(shù)研究。這樣一位學(xué)界與產(chǎn)業(yè)界都熟悉的“老兵”掛帥,本身就讓東方算芯的亮相多了一層份量。
這一次,東方算芯的亮相并不只是在介紹一顆芯片,而是在回答一個(gè)更大的產(chǎn)業(yè)問(wèn)題:當(dāng)先進(jìn)制程、HBM、先進(jìn)封裝和高端GPU供應(yīng)都面臨不確定性,中國(guó)AI芯片還能不能走出一條不完全復(fù)刻海外主流范式的新路?不依賴HBM,不依賴EUV光刻機(jī),東方算芯走的是一套叫“軟件定義+3D堆疊近存計(jì)算”的原創(chuàng)體系。DF1000芯片,是東方算芯交出的第一份答卷。這對(duì)中國(guó)半導(dǎo)體來(lái)說(shuō),很重要。這代表著國(guó)產(chǎn)高端算力不只有一條路,中國(guó)AI芯片也不必永遠(yuǎn)站在別人的坐標(biāo)系里。
01
算力之困,久矣
AI芯片,到底卡在哪里?而中國(guó)AI芯片,又卡在哪里?
先看AI芯片本身。在很長(zhǎng)一段時(shí)間里,市場(chǎng)習(xí)慣用“更先進(jìn)制程、更高峰值算力、更大HBM容量”理解高端AI芯片。這條路徑確實(shí)推動(dòng)了全球AI基礎(chǔ)設(shè)施快速迭代,也塑造了當(dāng)前主流GPU生態(tài)。
首先是制程。在摩爾定律推動(dòng)下,晶體管越做越小,芯片性能越來(lái)越強(qiáng),單位成本持續(xù)下降。很長(zhǎng)時(shí)間里,先進(jìn)制程就是高性能芯片最直接的答案。但今天,這條路越來(lái)越難。當(dāng)大模型進(jìn)入更大參數(shù)規(guī)模、更長(zhǎng)上下文、更高并發(fā)推理和訓(xùn)練集群階段,約束算力釋放的因素變得更復(fù)雜:晶體管繼續(xù)縮小的經(jīng)濟(jì)性下降,數(shù)據(jù)在計(jì)算單元與存儲(chǔ)之間搬運(yùn)的代價(jià)急劇上升,芯片、服務(wù)器、網(wǎng)絡(luò)、編譯器、運(yùn)行時(shí)和應(yīng)用框架之間的協(xié)同難度持續(xù)提高。
再看存儲(chǔ)。大模型時(shí)代,算力不是只靠“算”出來(lái)的。參數(shù)、激活值、中間結(jié)果、KV Cache,都要在存儲(chǔ)與計(jì)算之間高速流動(dòng)。芯片算得再快,數(shù)據(jù)喂不上去,算力就會(huì)被卡住。這就是“存儲(chǔ)墻”。HBM和2.5D先進(jìn)封裝,是海外主流高端AI芯片緩解存儲(chǔ)墻的重要方式。它們把帶寬推上去了,也把高端AI芯片帶進(jìn)了一個(gè)新的復(fù)雜系統(tǒng):更高的封裝難度、更緊張的產(chǎn)能、更高的成本、更大的供給不確定性,以及更復(fù)雜的功耗和散熱約束。換句話說(shuō),HBM是解法,但不是沒(méi)有代價(jià)的解法。它緩解了存儲(chǔ)墻,也在高端AI芯片系統(tǒng)里形成了新的資源約束。
這些,是AI芯片都會(huì)面對(duì)的問(wèn)題。
而對(duì)中國(guó)半導(dǎo)體而言,現(xiàn)實(shí)更復(fù)雜。先進(jìn)光刻設(shè)備、前沿工藝節(jié)點(diǎn)、HBM、高端先進(jìn)封裝產(chǎn)能以及相關(guān)工具鏈,都不再是可以按商業(yè)周期自然獲得的資源。如果國(guó)產(chǎn)AI芯片仍然沿著“先進(jìn)制程+HBM+2.5D先進(jìn)封裝”的既有路徑追趕,就很容易陷入一個(gè)被動(dòng)局面:追趕對(duì)象不斷迭代,關(guān)鍵環(huán)節(jié)又隨時(shí)可能被外部條件鎖住。于是,一個(gè)更根本的問(wèn)題擺在產(chǎn)業(yè)面前:能不能換道?
換道,說(shuō)起來(lái)容易,做起來(lái)很難。芯片產(chǎn)業(yè)不是一句概念就能改變的。真正能走通的路線,必須同時(shí)經(jīng)受住設(shè)計(jì)、制造、封裝、測(cè)試、板卡、服務(wù)器、軟件、客戶應(yīng)用的檢驗(yàn)。中國(guó)半導(dǎo)體并不缺想法,缺的是能夠被工程化驗(yàn)證的想法。東方算芯的意義,它給了中國(guó)半導(dǎo)體一條全新的路線,并且把這條路線走通了。
02
亮相,東方范式
二十年技術(shù)沉淀,兩年產(chǎn)業(yè)攻堅(jiān),三項(xiàng)關(guān)鍵工作。東方算芯給出的答案,可以概括為“軟件定義芯片+3D堆疊近存計(jì)算”。
![]()
一條主線是軟件定義芯片。什么是軟件定義芯片?簡(jiǎn)單來(lái)說(shuō)就是,讓硬件圍著算法走。傳統(tǒng)芯片更多是硬件先定型,軟件再去適配。東方算芯的軟件定義計(jì)算架構(gòu),則是構(gòu)建從硬件到軟件的全棧可重構(gòu)計(jì)算體系,動(dòng)態(tài)重構(gòu)多精度融合計(jì)算陣列,根據(jù)模型特性自動(dòng)選擇最優(yōu)數(shù)據(jù)通路;以Tensor Tile為基本調(diào)度單元,構(gòu)建全異步、無(wú)阻塞的數(shù)據(jù)流執(zhí)行引擎,提升計(jì)算資源利用效率。當(dāng)先進(jìn)制程不可輕易獲得時(shí),成熟工藝上的每一份硬件資源都必須被更充分地用起來(lái)。軟件定義架構(gòu)的價(jià)值,正在于把一部分原本依賴制程紅利獲得的性能提升,轉(zhuǎn)向由架構(gòu)、編譯、調(diào)度和系統(tǒng)協(xié)同共同釋放。
另一條主線是3D堆疊近存計(jì)算。大模型時(shí)代,數(shù)據(jù)搬運(yùn)正在成為比計(jì)算本身更昂貴的動(dòng)作。算力芯片可以繼續(xù)提高峰值運(yùn)算能力,但如果數(shù)據(jù)不能以足夠帶寬、足夠低能耗、足夠低延遲抵達(dá)計(jì)算單元,硬件利用率就會(huì)被“存儲(chǔ)墻”吞掉。東方算芯把邏輯層與DRAM層通過(guò)Hybrid Bonding混合鍵合方式做三維集成,形成近存計(jì)算架構(gòu)。通過(guò)晶圓級(jí)Cu-Cu混合鍵合三維集成工藝,把計(jì)算與存儲(chǔ)之間的數(shù)據(jù)傳輸路徑大幅縮短,提升互連密度、訪存帶寬和數(shù)據(jù)處理效率。不是在既有HBM路徑上做局部替代,而是試圖用一套新的存算組織方式,降低高端AI算力對(duì)外部關(guān)鍵存儲(chǔ)與封裝資源的硬性綁定。
從整體技術(shù)路線看,軟件定義芯片解決的是“算力怎么被更高效地用起來(lái)”,3D堆疊近存計(jì)算解決的是“數(shù)據(jù)怎么更快、更近、更低功耗地抵達(dá)計(jì)算單元”。這兩個(gè)技術(shù)放在一起,才構(gòu)成東方算芯路線的關(guān)鍵:在成熟工藝條件下,憑借軟件定義芯片和3D近存計(jì)算技術(shù)提升資源利用率與訪存效率,等效實(shí)現(xiàn)先進(jìn)制程產(chǎn)品性能,進(jìn)而彌補(bǔ)制程代差。因此,不是說(shuō)制程不重要,而是說(shuō)當(dāng)制程不再是唯一可依賴的紅利來(lái)源時(shí),中國(guó)AI芯片必須找到新的性能釋放方式。如果能達(dá)到先進(jìn)制程的條件下,這套系統(tǒng)將會(huì)帶來(lái)更加巨大的性能釋放。更進(jìn)一步,東方算芯還構(gòu)建了原生分布式執(zhí)行模型。面向云端大模型訓(xùn)練與推理的規(guī)模化需求,它從芯片級(jí)軟件定義通信處理器、服務(wù)器級(jí)原生以太網(wǎng)超節(jié)點(diǎn),到軟件級(jí)原生分布式編程模型與運(yùn)行時(shí),形成從芯片到集群的原生分布式算力體系。
東方算芯并不是只看一顆芯片的峰值指標(biāo),而是在思考真實(shí)算力如何被調(diào)度、被連接、被部署、被使用。這就是“東方范式”的核心。它不是對(duì)海外路線的小修小補(bǔ),而是在制程受限、HBM受限的現(xiàn)實(shí)條件下,重新組織計(jì)算、存儲(chǔ)、通信和軟件棧。中國(guó)半導(dǎo)體不必持續(xù)復(fù)刻歐美發(fā)展老路。依靠原創(chuàng)系統(tǒng)級(jí)技術(shù)理念創(chuàng)新,完全可以走出一條適配國(guó)內(nèi)產(chǎn)業(yè)基礎(chǔ)、可控、可持續(xù)迭代的先進(jìn)半導(dǎo)體發(fā)展路線。
03
突圍,中國(guó)路徑
一條新路線,只有走到工程化和產(chǎn)業(yè)化階段,才真正具備說(shuō)服力。DF1000芯片基于14nm工藝,全國(guó)產(chǎn)供應(yīng)鏈打造,訓(xùn)推一體,實(shí)現(xiàn)520TFLOPS@BF16,6.4TB/s顯存帶寬。并且從東方算芯披露的產(chǎn)品矩陣看,DF1000并不是孤立發(fā)布。基于DF1000這顆芯片,東方算芯這次一次性亮出了完整產(chǎn)品矩陣:巔峯DF1000 AI加速卡、擎元QY100服務(wù)器、拓域TY64超節(jié)點(diǎn)、慧算HS512集群,覆蓋從單卡到整機(jī)、從節(jié)點(diǎn)到集群的部署形態(tài)。
![]()
![]()
從芯片應(yīng)用產(chǎn)品矩陣來(lái)看,這是一條完整的算力交付鏈路。DF1000是底層算力核心,巔峯DF1000 AI加速卡解決標(biāo)準(zhǔn)化交付,擎元QY100服務(wù)器解決整機(jī)部署,拓域TY64超節(jié)點(diǎn)解決高密度互聯(lián),慧算HS512集群解決規(guī)模擴(kuò)展。它們合在一起,呈現(xiàn)的是從芯片到集群、從技術(shù)路線到商業(yè)交付的閉環(huán)。這套產(chǎn)品矩陣能夠面向互聯(lián)網(wǎng)、人工智能、金融、超高性能計(jì)算等復(fù)雜應(yīng)用場(chǎng)景,支持大模型訓(xùn)練、端到端推理、P/D分離式推理與AFD分布式推理等多種AI計(jì)算模式。這也是AI芯片走向產(chǎn)業(yè)化必須跨過(guò)的一步。芯片如果不能進(jìn)入板卡,就不能交付;板卡如果不能進(jìn)入服務(wù)器,就不能部署;服務(wù)器如果不能擴(kuò)展成集群,就無(wú)法支撐大模型時(shí)代的真實(shí)負(fù)載。因此,這一次是東方算芯把軟件定義近存計(jì)算路線推進(jìn)到系統(tǒng)層、交付層和應(yīng)用層的一次集中呈現(xiàn)。
![]()
從芯片制造幾大環(huán)節(jié)來(lái)看,這是一次全國(guó)產(chǎn)化制造的突圍。DF1000產(chǎn)品已完成從芯片設(shè)計(jì)、晶圓制造、3D先進(jìn)封裝到封測(cè)的全鏈條國(guó)產(chǎn)化貫通,具備規(guī)模化量產(chǎn)與交付條件。也就是說(shuō),東方算芯已經(jīng)把一條新架構(gòu)路線推進(jìn)到可制造、可封裝、可測(cè)試、可交付的工程階段。
另外本次發(fā)布會(huì)也看到后續(xù)的快節(jié)奏產(chǎn)品上市,今年Q4東方算芯將推出DF2000,能夠達(dá)到訪存帶寬15 TB/s,1000TFLOPS@BF16,性能參數(shù)全面超越英偉達(dá)H200;2027年Q4將會(huì)推出DF3000,能夠達(dá)到訪存帶寬20 TB/s,2000TFLOPS@BF16,在DF2000的基礎(chǔ)上翻倍提升,對(duì)標(biāo)英偉達(dá)B300。
![]()
東方算芯構(gòu)建了自主可控、可持續(xù)演進(jìn)的中國(guó)算力產(chǎn)業(yè)新生態(tài),組織成一套新的技術(shù)路線。這條新路線把中國(guó)半導(dǎo)體企業(yè)很多分散的能力組織起來(lái),把國(guó)產(chǎn)供應(yīng)鏈從“能不能替代”推向“能不能協(xié)同創(chuàng)新”,把單點(diǎn)突破推向系統(tǒng)突破。也正因?yàn)槿绱耍瑬|方算芯在發(fā)布技術(shù)路線之外提出“共建、共筑、共贏”的產(chǎn)業(yè)主張。魏少軍教授說(shuō)到:“DF1000芯片和系統(tǒng)產(chǎn)品的成功,是全體合作伙伴的集體成功,是建立在國(guó)家全產(chǎn)業(yè)鏈深厚基礎(chǔ)上的成功。可以說(shuō),沒(méi)有產(chǎn)業(yè)鏈各環(huán)節(jié)合作伙伴突破常規(guī)的合作模式的結(jié)構(gòu)與支持,就沒(méi)有今天東方算芯產(chǎn)品的面世。”這條路,不是一家公司的路。它需要很多國(guó)產(chǎn)供應(yīng)鏈伙伴一起完成,也會(huì)反過(guò)來(lái)帶動(dòng)這些伙伴一起向上。這樣的協(xié)同一旦跑通,中國(guó)芯片產(chǎn)業(yè)鏈的能力就不只是“補(bǔ)齊”,而是在共同升級(jí)。
04
結(jié)語(yǔ)
東方算芯的首次芯片、系統(tǒng)與路線圖發(fā)布會(huì),恰好發(fā)生在WAIC前夕這樣一個(gè)關(guān)鍵節(jié)點(diǎn)。
AI應(yīng)用正在加速爆發(fā),大模型正在進(jìn)入產(chǎn)業(yè)深處,算力正在成為數(shù)字經(jīng)濟(jì)的基礎(chǔ)設(shè)施。越是這樣的時(shí)刻,中國(guó)越需要自己的高性能計(jì)算底座。這條底座,不能永遠(yuǎn)建立在不確定的外部供應(yīng)上;這條路,也不能永遠(yuǎn)靠復(fù)刻別人的答案前行。
中國(guó)半導(dǎo)體需要追趕,也需要換道。需要補(bǔ)短板,也需要開(kāi)新路。東方算芯堅(jiān)持自主創(chuàng)新、開(kāi)放合作,堅(jiān)持長(zhǎng)期主義、耐心投入,立足上海,布局全國(guó),面向世界。正如今日魏少軍教授所言:“算力自主是國(guó)之大事,芯片突破是時(shí)代使命。東方算芯生逢其時(shí),也重任在肩。”
東方算芯給出的,不只是DF1000這顆芯片,也不只是巔峯、擎元、拓域、慧算這套產(chǎn)品矩陣。它真正給出的,是一個(gè)信號(hào):在制程、存儲(chǔ)、封裝、系統(tǒng)都面臨挑戰(zhàn)的今天,中國(guó)AI芯片依然可以用原創(chuàng)架構(gòu)、全國(guó)產(chǎn)供應(yīng)鏈和工程化落地能力,走出自己的東方范式。
【AI疊變】第一期:東方算芯。成立于2024年,總部位于上海張江,由清華大學(xué)長(zhǎng)聘教授、國(guó)際歐亞科學(xué)院院士、國(guó)家集成電路產(chǎn)業(yè)發(fā)展咨詢委員會(huì)委員魏少軍創(chuàng)立并擔(dān)任董事長(zhǎng)兼CEO,國(guó)家人工智能產(chǎn)業(yè)基金、上海國(guó)投先導(dǎo)、上海集成電路產(chǎn)業(yè)投資基金等參投。它誕生于中國(guó)高端算力亟需自主路徑的關(guān)鍵時(shí)刻,立足國(guó)產(chǎn)AI算力短板,從軟件定義芯片和3D堆疊近存計(jì)算切入,在先進(jìn)制程、HBM和高端封裝受限的背景下,東方范式引領(lǐng)算力新趨勢(shì)。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.