![]()
本屆世界人工智能大會WAIC期間,靈汐科技正式重磅發(fā)布自研類腦超節(jié)點集群產(chǎn)品——LynAInfra(靈琍),以全鏈路自研的類腦算力方案,破解當下AI推理行業(yè)痛點,為國產(chǎn)高速推理賽道帶來全新選擇。
![]()
當前人工智能行業(yè)發(fā)展遇到明顯桎梏,能耗過高、推理延遲偏高兩大難題,持續(xù)阻礙AI推理業(yè)務大規(guī)模落地。即便GPU產(chǎn)品迭代更新,傳統(tǒng)芯片架構(gòu)的底層局限依舊無法被打破;但市場端推理需求迎來爆發(fā),未來推理業(yè)務將占據(jù)AI基礎設施市場80%以上份額。
伴隨著Token經(jīng)濟興起,AI編程加速、AI視頻生成、多智能體協(xié)同等高價值場景,對推理時延和使用成本提出更高標準,GPU方案運營開銷大、首token延遲偏高的短板愈發(fā)突出,英偉達布局Groq加碼高速推理賽道,也印證行業(yè)正在急切尋找推理架構(gòu)革新方案。
立足行業(yè)現(xiàn)狀,靈汐科技依托自研類腦芯片存算一體、事件驅(qū)動、眾核并行的先天特質(zhì),發(fā)揮低功耗、低時延核心優(yōu)勢,傾力打造面向高速推理場景的LynAInfra類腦高性能超節(jié)點,對標創(chuàng)新版Groq。
相較傳統(tǒng)GPU方案,產(chǎn)品推理能效比提升3-10倍,首token延遲壓縮至幾十到百毫秒級別,兼顧強悍推理性能與出色能耗水平,樹立起“瓦特換比特”的算力全新標桿。
LynAInfra靈琍一體化超節(jié)點集群由靈汐科技完全自主研發(fā),依托國內(nèi)已實現(xiàn)規(guī)模化商用落地的類腦芯片構(gòu)建。LynAInfra128算力柜搭載128張HP640系列板卡,單柜級聯(lián)數(shù)千顆類腦芯片,釋放近100P@FP16算力,整機功耗控制在30kW以內(nèi)。
依托自研LynxLink高速互聯(lián)協(xié)議以及統(tǒng)一內(nèi)存地址編譯技術(shù),產(chǎn)品既支持單機柜算力提升(Scale up),也可以多機柜橫向擴展(Scale out),打破單卡、單節(jié)點顯存和算力上限,適配不同體量大模型部署任務。設備采用風冷散熱方案,模塊化設計兼容現(xiàn)有智算中心機柜、供電、網(wǎng)絡配套設施,大幅降低客戶部署改造成本。
![]()
LynAInfra實現(xiàn)從芯片架構(gòu)到集群互聯(lián)的全鏈路創(chuàng)新。多機柜之間可以做到無感級聯(lián),輕松承載超大模型運行任務,將推理性能與能效比推向行業(yè)前列。
放眼產(chǎn)業(yè)長遠價值,LynAInfra128憑借架構(gòu)級節(jié)能優(yōu)勢,用30kW功耗撐起近100P算力,減少算力使用過程中的碳排放,助力智算中心綠色建設,響應國家雙碳戰(zhàn)略;對于企業(yè)客戶而言,可以顯著降低大模型推理的單位算力開銷,縮減整體擁有成本,助力大模型落地于產(chǎn)業(yè)數(shù)字化、城市治理、前沿科研等場景;更深層次來看,整套方案堅持國產(chǎn)自主創(chuàng)新路線,擺脫國外算力架構(gòu)束縛,加固國產(chǎn)算力供應鏈安全,以類腦創(chuàng)新算力賦能數(shù)字經(jīng)濟高質(zhì)量發(fā)展。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.