![]()
本屆世界人工智能大會WAIC期間,靈汐科技正式重磅發布自研類腦超節點集群產品——LynAInfra(靈琍),以全鏈路自研的類腦算力方案,破解當下AI推理行業痛點,為國產高速推理賽道帶來全新選擇。
![]()
當前人工智能行業發展遇到明顯桎梏,能耗過高、推理延遲偏高兩大難題,持續阻礙AI推理業務大規模落地。即便GPU產品迭代更新,傳統芯片架構的底層局限依舊無法被打破;但市場端推理需求迎來爆發,未來推理業務將占據AI基礎設施市場80%以上份額。
伴隨著Token經濟興起,AI編程加速、AI視頻生成、多智能體協同等高價值場景,對推理時延和使用成本提出更高標準,GPU方案運營開銷大、首token延遲偏高的短板愈發突出,英偉達布局Groq加碼高速推理賽道,也印證行業正在急切尋找推理架構革新方案。
立足行業現狀,靈汐科技依托自研類腦芯片存算一體、事件驅動、眾核并行的先天特質,發揮低功耗、低時延核心優勢,傾力打造面向高速推理場景的LynAInfra類腦高性能超節點,對標創新版Groq。
相較傳統GPU方案,產品推理能效比提升3-10倍,首token延遲壓縮至幾十到百毫秒級別,兼顧強悍推理性能與出色能耗水平,樹立起“瓦特換比特”的算力全新標桿。
LynAInfra靈琍一體化超節點集群由靈汐科技完全自主研發,依托國內已實現規模化商用落地的類腦芯片構建。LynAInfra128算力柜搭載128張HP640系列板卡,單柜級聯數千顆類腦芯片,釋放近100P@FP16算力,整機功耗控制在30kW以內。
依托自研LynxLink高速互聯協議以及統一內存地址編譯技術,產品既支持單機柜算力提升(Scale up),也可以多機柜橫向擴展(Scale out),打破單卡、單節點顯存和算力上限,適配不同體量大模型部署任務。設備采用風冷散熱方案,模塊化設計兼容現有智算中心機柜、供電、網絡配套設施,大幅降低客戶部署改造成本。
![]()
LynAInfra實現從芯片架構到集群互聯的全鏈路創新。多機柜之間可以做到無感級聯,輕松承載超大模型運行任務,將推理性能與能效比推向行業前列。
放眼產業長遠價值,LynAInfra128憑借架構級節能優勢,用30kW功耗撐起近100P算力,減少算力使用過程中的碳排放,助力智算中心綠色建設,響應國家雙碳戰略;對于企業客戶而言,可以顯著降低大模型推理的單位算力開銷,縮減整體擁有成本,助力大模型落地于產業數字化、城市治理、前沿科研等場景;更深層次來看,整套方案堅持國產自主創新路線,擺脫國外算力架構束縛,加固國產算力供應鏈安全,以類腦創新算力賦能數字經濟高質量發展。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.