7月13日,我國首顆采用軟件定義與三維近存計算技術的AI芯片在上海正式亮相,由成立僅兩年的東方算芯科技有限公司發(fā)布,命名為DF1000。這顆芯片基于14納米制程工藝,實現(xiàn)了每秒520萬億次浮點運算的算力,訪存帶寬達每秒6.4TB,最大特點是通過底層架構創(chuàng)新,走出一條不依賴先進制程的高端算力發(fā)展路徑。
![]()
要理解這次突破,先得明白傳統(tǒng)計算機的“存算分離”架構。目前全球主流芯片遵循馮·諾依曼架構:計算單元與存儲單元分開,數(shù)據(jù)通過“總線”搬運,形成長期困擾芯片設計的“存儲墻”瓶頸——處理器運算速度遠超內存帶寬,計算單元常處于“等待數(shù)據(jù)”的空閑狀態(tài)。
而DF1000采用三維垂直堆疊技術,將計算層與存儲層通過3D混合鍵合緊密集成在一起,互連間距壓縮至亞微米級別,帶來數(shù)量級提升的互連密度與帶寬密度。這相當于把數(shù)據(jù)搬運從“穿院子”變成了“穿墻”,從根本上緩解了“存儲墻”問題。
東方算芯董事長魏少軍在發(fā)布會上表示,當前AI算法幾乎每三個月到半年就有大變化,專用路線(DSA)靈活性不足;而通用路線(GPGPU)又高度依賴先進制程。DF1000選擇的“軟件定義+三維近存計算”路線,不依賴最先進的國際工藝就能實現(xiàn)高性能,不依賴國際上受限的大容量存儲就能實現(xiàn)高存儲量和大帶寬。
這項技術并非一蹴而就。據(jù)魏少軍介紹,團隊從2006年開始研究可重構計算芯片,原意是解決多品種小批量芯片的單位成本問題。隨著大模型引爆算力需求,這項技術迎來了產業(yè)機遇。
從2006年立項到2026年量產,整整二十年時間。同步發(fā)布的還有配套的全棧軟件工具鏈,兼容主流深度學習框架,形成從單張加速卡、AI服務器到液冷超節(jié)點、大規(guī)模智算集群的完整產品體系。
業(yè)內認為,這標志著我國在高端算力芯片領域探索出了一條以架構創(chuàng)新代替制程追隨的自主發(fā)展新路。正如魏少軍所言:“工藝依然是最終的天花板。如果哪天我們有更好的工藝,一定會做得更好。”
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.