近日,在2026年上海世界移動通信大會上,中興通訊通過“從芯片、整機、集群、AIDC,到軟件算法和調度平臺”多個維度的協同設計、深度優化和加速,全面提升TPS,助力客戶構建TCO最優的AI工廠,全面支撐Token經濟的高效發展。
![]()
隨著大模型進入推理規模化落地階段,“每Token成本”成為衡量AI商業價值的核心指標。中興通訊提出,只有通過架構級創新與系統級協同,才能實現Token生成效率的躍升。本次展出的基于OEX架構的超節點,正是破解算力瓶頸、提升能效比的關鍵創新成果。
首創OEX架構,定義下一代超節點標準
中興通訊首創正交架構超節點理念,OEX(Orthogonal Electrical eXchange)架構采用無背板、0線纜設計,實現GPU、CPU、交換芯片等核心組件的物理解耦與靈活替換,支持CLink、SUE等主流高速互聯協議,真正實現了“多芯協同、開放兼容、按需擇優”。相比傳統架構,基于OEX架構的超節點通信路徑更短、信號損耗更低,整機互聯效率明顯提升,時延有效降低,系統可靠性更強。
中興超節點單機柜實現128卡超高密集成,業界領先,并可Scale up至1.6萬卡,構建超大規模集群,滿足從千卡到萬卡級AI訓練與推理需求,為長會話、高并發的智能體場景提供堅實底座。
極致協同,推理效率與算力能效全面躍升
軟硬協同,釋放極致能效。通過多樣資源精準調度與語義感知的智能路由,實現算力最優匹配,大幅降低推理成本。采用PD分離架構,結合網絡提效、算子優化與多級KV緩存等技術,突破性能瓶頸,大幅提升吞吐能力。聯合多廠商深度協同,在國產芯片平臺推進異構混推與系統級調優,全面增強推理效率,實現TPS顯著增長。
算存網協同,構建超大規模推理池。提供全系列AI服務器,支持單機8卡、16卡及單柜64卡/128卡高密部署,適配多場景需求。以DPU為核心打造AI原生KV緩存,實現GPU直通,零拷貝、微秒級時延與PB級擴展,結合智能預取與動態淘汰,緩存命中率超70%,有效提升推理效率。
攜手生態,共建開放可演進的AI基礎設施
中興通訊強調,AI算力建設需兼顧性能、成本與可持續演進。中興通訊基于OEX架構的超節點采用“算力集裝箱”模式,通過前置式開發與統一工程規范,將新產品適配周期從一年縮短至半年內,加速生態融合與規模部署。
高效算力是Token經濟的基石,中興通訊致力于讓每一份算力都轉化為實實在在的AI產出。此次展示充分體現了中興通訊在智算基礎設施領域的技術底蘊和創新能力,也為客戶提供了面向未來的高效AI工廠構建路徑。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.