C114訊 7月17日消息(岳明)比上海高溫天氣還要火熱的,是今日正式開(kāi)幕的2026世界人工智能大會(huì)(WAIC)現(xiàn)場(chǎng)觀眾對(duì)超節(jié)點(diǎn)的熱情。
C114在WAIC現(xiàn)場(chǎng)留意到,一塊塊寫(xiě)著“WAIC鎮(zhèn)館之寶”的橫幅佇立在多家企業(yè)的超節(jié)點(diǎn)產(chǎn)品旁邊,每一個(gè)有超節(jié)點(diǎn)方案的展臺(tái)都“擁堵”著水泄不通的人群,并且,每一家攜超節(jié)點(diǎn)產(chǎn)品亮相的企業(yè),都將其置于了展臺(tái)的“門(mén)面”或“C位”。
毫無(wú)疑問(wèn),超節(jié)點(diǎn)已成為當(dāng)下中國(guó)AI基礎(chǔ)設(shè)施最關(guān)鍵的產(chǎn)品形態(tài),而WAIC 2026則是對(duì)最新國(guó)產(chǎn)超節(jié)點(diǎn)產(chǎn)品解決方案的一次集中檢閱。這同時(shí)意味著,一個(gè)以系統(tǒng)架構(gòu)創(chuàng)新突破物理極限為核心目標(biāo)的全新AI算力時(shí)代已經(jīng)到來(lái)。
![]()
百花齊放:國(guó)產(chǎn)超節(jié)點(diǎn)的“集團(tuán)沖鋒”
在2025年9月的華為全聯(lián)接大會(huì)上,華為輪值董事長(zhǎng)徐直軍正式發(fā)布了昇騰950超節(jié)點(diǎn)(Atlas 950 SuperPoD),當(dāng)時(shí)他給出的上市時(shí)間表為“2026年第四季度”。2026年3月MWC巴塞羅那大會(huì)上,華為已開(kāi)始展示產(chǎn)品方案;而在今天的WAIC上,昇騰950超節(jié)點(diǎn)的真機(jī)已直接擺上展臺(tái)。這種研發(fā)與工程化速度的提升幅度,足以讓人重新審視國(guó)產(chǎn)超節(jié)點(diǎn)技術(shù)的成熟度。
華為方面表示,昇騰950超節(jié)點(diǎn)主要面向下一代萬(wàn)億級(jí)大模型訓(xùn)練,以單機(jī)柜集成64張昇騰計(jì)算卡為基本單元,基于靈衢互聯(lián)協(xié)議,實(shí)現(xiàn)了業(yè)界最大規(guī)模的1024卡集群,提供1 EFLOPS FP8、2 EFLOPS FP4算力與256TB全局統(tǒng)一內(nèi)存編址,旨在進(jìn)一步突破大模型訓(xùn)練與高并發(fā)推理的性能瓶頸。
![]()
C114了解到,昇騰950超節(jié)點(diǎn)最高可擴(kuò)展至8192張Ascend 950DT芯片。這一規(guī)模相當(dāng)于去年上市的昇騰384超節(jié)點(diǎn)的20余倍。華為在超節(jié)點(diǎn)技術(shù)研發(fā)上采取了全棧自研路線:從芯片(昇騰NPU)到互聯(lián)協(xié)議(靈衢),再到系統(tǒng)軟件與散熱方案,均實(shí)現(xiàn)了自主研發(fā)。
中興通訊則聯(lián)合曦智科技、壁仞科技、沐曦股份、燧原科技、天數(shù)智芯等多家合作伙伴,基于OEX+dOCS架構(gòu)打造了國(guó)產(chǎn)高性能Matrix超節(jié)點(diǎn),該方案以O(shè)EX正交超節(jié)點(diǎn)為基座,通過(guò)分布式dOCS光交換實(shí)現(xiàn)動(dòng)態(tài)拓?fù)渚幣牛交瑪U(kuò)展。
![]()
該方案是國(guó)內(nèi)少數(shù)同時(shí)滿足128卡高密度、多芯片混插、dOCS算網(wǎng)一體化液冷的系統(tǒng)。C114了解到,這一方案斬獲了今年WAIC SAIL之星獎(jiǎng)項(xiàng)。中興主張多芯協(xié)同,面向不同應(yīng)用場(chǎng)景自主選擇國(guó)產(chǎn)最優(yōu)芯片組合,打造TCO最優(yōu)的算力底座。
新華三現(xiàn)場(chǎng)展出的UniPoD S80000系列覆蓋32卡到1024卡,最高可擴(kuò)展至16384卡,強(qiáng)調(diào)“算—網(wǎng)—存—云—安—維”六大維度的全棧協(xié)同能力。聯(lián)想也展出了問(wèn)天超節(jié)點(diǎn)算力解決方案,單節(jié)點(diǎn)可搭載40張GPU,F(xiàn)P8算力超28 PFLOPS,HBM顯存突破5.76 TB,可滿足萬(wàn)億參數(shù)大模型訓(xùn)練與推理極致需求。海光與中科曙光則形成了“芯片+系統(tǒng)”的深度協(xié)同——海光提供CPU+DCU芯片,中科曙光負(fù)責(zé)系統(tǒng)集成——ScaleX640+ScaleX40超節(jié)點(diǎn),雙方在本月剛剛宣布中國(guó)首個(gè)全國(guó)產(chǎn)十萬(wàn)卡AI超集群“曙光8000(登峰)”正式落成。
![]()
![]()
與此同時(shí),沐曦股份、燧原科技等國(guó)產(chǎn)GPU廠商則選擇了“從芯片向上延伸”的路徑。這些企業(yè)從芯片研發(fā)向系統(tǒng)級(jí)產(chǎn)品延伸,推出配套的超節(jié)點(diǎn)方案與自研互連協(xié)議,構(gòu)建“芯片—服務(wù)器—超節(jié)點(diǎn)—集群”的全棧國(guó)產(chǎn)算力產(chǎn)品矩陣。
![]()
其中,沐曦股份此次首發(fā)了曦景S600超節(jié)點(diǎn),采用自研全精度GPGPU架構(gòu)+MXMACA軟件棧覆蓋智算、通算全場(chǎng)景;燧原科技也首發(fā)了新一代燧原超節(jié)點(diǎn)系統(tǒng)——云燧ESL64-O超節(jié)點(diǎn),實(shí)現(xiàn)“芯片—模組—系統(tǒng)—模型—應(yīng)用”五層高效協(xié)同設(shè)計(jì),性能與能效大幅提升。
![]()
致力于高性能算力芯片研發(fā)的東方算芯也在現(xiàn)場(chǎng)展出了完整的超節(jié)點(diǎn)解決方案。其超節(jié)點(diǎn)方案單柜配置64卡自研AI加速卡——DF1000系列OAM模組,可提供33P@BF16算力,單卡支持896GB/s高速互聯(lián)。展臺(tái)工作人員告訴C114,該方案可支持萬(wàn)億級(jí)參數(shù)的AI應(yīng)用。
![]()
此外,以阿里、百度為代表的互聯(lián)網(wǎng)大廠也都在本屆WAIC展出了自己的超節(jié)點(diǎn)產(chǎn)品。阿里云攜真武M890 x磐久AL128超節(jié)點(diǎn)獲選WAIC“鎮(zhèn)館之寶”,百度旗下昆侖芯所支持的超節(jié)點(diǎn)產(chǎn)品已實(shí)現(xiàn)量產(chǎn)落地。
![]()
![]()
這種百花齊放的景象釋放出一個(gè)明確信號(hào):中國(guó)AI Infra已迎來(lái)超節(jié)點(diǎn)時(shí)代,智算產(chǎn)業(yè)正從“單點(diǎn)突破”全面邁入“系統(tǒng)級(jí)競(jìng)爭(zhēng)”的新階段。
超節(jié)點(diǎn)為何成了必選項(xiàng)?
需要明確的是,超節(jié)點(diǎn)的爆發(fā)并非中國(guó)企業(yè)的獨(dú)角戲。
現(xiàn)場(chǎng)技術(shù)專家在與C114的交流中指出,超節(jié)點(diǎn)絕非中國(guó)市場(chǎng)的“一頭熱”,而是一種全球技術(shù)主流發(fā)展趨勢(shì),因?yàn)檫@代表著當(dāng)下的最優(yōu)解做法。
![]()
從技術(shù)發(fā)展來(lái)看,摩爾定律的逐步失效使產(chǎn)業(yè)界不再執(zhí)著于單點(diǎn)工藝的突破,轉(zhuǎn)而向“空間”與“連接”要算力。與此同時(shí),現(xiàn)代計(jì)算的瓶頸早已不再是單純的算力(FLOPS),而是數(shù)據(jù)搬運(yùn)的速度與能耗,即所謂的“內(nèi)存墻”和“通信墻”。
超節(jié)點(diǎn)通過(guò)高速互聯(lián)技術(shù)將數(shù)百至數(shù)千顆AI芯片整合為一個(gè)統(tǒng)一的龐大算力池,它以超低延遲(納秒級(jí))和高帶寬實(shí)現(xiàn)內(nèi)存池化,使每一顆芯片都能像訪問(wèn)本地緩存一樣訪問(wèn)遠(yuǎn)端內(nèi)存,從而在邏輯上凝聚為一臺(tái)性能強(qiáng)悍、管理統(tǒng)一的“超級(jí)計(jì)算機(jī)”,這種系統(tǒng)性的架構(gòu)重塑有效打破了傳統(tǒng)服務(wù)器集群的性能瓶頸。
![]()
從市場(chǎng)需求來(lái)看,AI產(chǎn)業(yè)正從訓(xùn)練主導(dǎo)加速邁向推理主導(dǎo)。大模型參數(shù)規(guī)模的競(jìng)賽已趨于平緩,但Agent、AI搜索、實(shí)時(shí)交互等應(yīng)用對(duì)推理算力的需求卻呈指數(shù)級(jí)增長(zhǎng)。推理任務(wù)需要頻繁、高速地訪問(wèn)分布在多張GPU上的KV Cache,這對(duì)芯片間的互聯(lián)帶寬與延遲提出了遠(yuǎn)高于訓(xùn)練階段的要求。超節(jié)點(diǎn)架構(gòu)將所有加速器的內(nèi)存整合為統(tǒng)一共享池,恰好能夠精準(zhǔn)滿足這一需求。現(xiàn)場(chǎng)溝通中,多家超節(jié)點(diǎn)廠商都將產(chǎn)品的應(yīng)用場(chǎng)景指向了“高性能推理”。
另外,對(duì)中國(guó)市場(chǎng)而言,發(fā)展超節(jié)點(diǎn)尤其具有戰(zhàn)略必然性。在先進(jìn)制程工藝受限的背景下,國(guó)產(chǎn)AI芯片單卡性能與國(guó)際領(lǐng)先水平存在客觀差距,而超節(jié)點(diǎn)提供了一條務(wù)實(shí)的追趕路徑——用系統(tǒng)優(yōu)勢(shì)彌補(bǔ)單點(diǎn)不足。這也是實(shí)現(xiàn)算力自主可控的關(guān)鍵一環(huán)。在當(dāng)前國(guó)際地緣政治環(huán)境下,國(guó)產(chǎn)替代已從備選變?yōu)楸剡x。
通過(guò)對(duì)大量產(chǎn)品信息的梳理與WAIC現(xiàn)場(chǎng)的實(shí)際溝通,C114觀察到國(guó)產(chǎn)超節(jié)點(diǎn)發(fā)展呈現(xiàn)出一些顯著特征:不少企業(yè)采取了“全棧自研”的打法,并專注于自身生態(tài)構(gòu)建;正交架構(gòu)出現(xiàn)在越來(lái)越多超節(jié)點(diǎn)產(chǎn)品當(dāng)中,漸成主流;盡管有些超節(jié)點(diǎn)方案此次為首次亮相,但實(shí)際已斬獲一定數(shù)量的訂單。
![]()
可以推斷,超節(jié)點(diǎn)技術(shù)在國(guó)內(nèi)市場(chǎng)已進(jìn)入規(guī)模化部署的前夜。
C114獲悉,華為昇騰384超節(jié)點(diǎn)已實(shí)現(xiàn)商用落地750多套——國(guó)產(chǎn)大規(guī)模算力集群已跨越了“技術(shù)可行”到“商業(yè)可用”的鴻溝。目前,昇騰384超節(jié)點(diǎn)已廣泛應(yīng)用于互聯(lián)網(wǎng)、運(yùn)營(yíng)商、金融、教育、醫(yī)療、交通、制造等20多個(gè)行業(yè)的核心生產(chǎn)場(chǎng)景。
今年4月,中國(guó)移動(dòng)啟動(dòng)了2026-2027年人工智能超節(jié)點(diǎn)設(shè)備集采,規(guī)模達(dá)6208張AI加速卡——776套計(jì)算節(jié)點(diǎn)。這是三大電信運(yùn)營(yíng)商在集團(tuán)層面首次開(kāi)展AI超節(jié)點(diǎn)設(shè)備集采,標(biāo)志著運(yùn)營(yíng)商算力建設(shè)正從“通用服務(wù)器堆疊”向“高性能超節(jié)點(diǎn)架構(gòu)”實(shí)現(xiàn)戰(zhàn)略轉(zhuǎn)型。
據(jù)華泰證券測(cè)算,2028年中國(guó)超節(jié)點(diǎn)市場(chǎng)規(guī)模有望達(dá)到3414億元,2026年至2028年復(fù)合增長(zhǎng)率達(dá)194%。我們看到,WAIC 2026不僅是國(guó)產(chǎn)超節(jié)點(diǎn)現(xiàn)階段成果的一次集中展示,更宣告了AI算力競(jìng)爭(zhēng)“系統(tǒng)為王”新周期的到來(lái)。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.