![]()
新聞公開報道的永遠是別人想讓你知道的信息,而真相往往被掩藏在深處,直到掌控者認為外界有必要知道時,才會公開。
上個月,DeepSeek達成500億融資,并開啟大規模招聘的消息傳播全球,表面上看,DeepSeek將未來發展目標定在了Harness和Agent等前沿領域,為此不惜招兵買馬、大肆擴軍備戰。
Harness、Agent固然重要,但仍停留在軟件層面,梁文鋒補齊這塊短板,只是常規操作。DeepSeek真正的殺招,根本不會寫在商業計劃書或招聘文案里,而是秘密進行,越少人知道越好。
近日,有外媒披露,早在一年前,DeepSeek已秘密啟動自研芯片項目,并與包括芯片設計公司、晶圓廠、存儲芯片企業在內的整條產業鏈密集接觸,探討可能的量產方案。
另有消息人士指出,其實DeepSeek一直有在招聘芯片人才,只不過都在私下進行,未向社會公開而已。
那么,為什么偏偏在這個時間點自研項目被曝光了?
可能的答案只有一個:梁文鋒認為時機成熟了,現在可以說了。
據推測,當下DeepSeek自研的AI芯片已快進入流片階段。這意味著,通過測試后,量產當在不遠。
![]()
AI芯片參考圖
造芯絕非易事,即使是財大氣粗的頭部企業,也往往會因其高昂的試錯成本望而卻步。梁文鋒為何要走這步險棋?
首先源于懸在DeepSeek頭頂的“算力焦慮”。
正如梁文鋒去年接受采訪時說的那樣:制約國產AI發展的“從來不是錢,而是高端芯片的短缺”。比如,前段時間,就有消息認為國內某款大模型能力遲遲無法取得突破,就是因為高端GPU不夠用了,訓練效率大打折扣。
在當下復雜多變的國際貿易環境下,海外高端GPU的供應始終充滿變數,國產大模型企業的咽喉隨時面臨被別人卡住的危險。既然錢對DeepSeek不是問題,那么把巨額資金轉化為底層可控的自主硬件,筑高算力的安全邊界,就成了DeepSeek必須考慮的問題。
此外,我們還可以從商業角度,分析梁文鋒的決定。
這次,DeepSeek自研的是推理芯片。這種芯片與訓練芯片有本質差異,一是技術難度沒有那么高;二是推理能力決定了用戶使用大模型的體驗——更快、更精準的響應。
去年底AI行業掀起新一輪Token熱潮,不少大模型廠商因算力成本高企而被迫漲價,但DeepSeek卻憑借極致的成本控制打響了降價甚至免費的拉鋸戰,市場份額達到了19%,位居全球榜首。但這種跑馬圈地的打法,對底層推理能力提出了更苛刻的要求。
通過自研專用的推理芯片,DeepSeek能夠從硬件底層去精準匹配自家的模型架構,而不是用外部的“大路貨”,從而將單次推理和生成Token的邊際成本一壓再壓。一旦跑通這條商業化閉環,梁文鋒便能在未來的Token價格戰中取得更大的降價空間。
![]()
事實上,這種“由軟到硬”的戰略延伸,并非DeepSeek一家公司的策略,而是已演變成全球頭部AI大模型巨頭的共識。
放眼海內外,OpenAI已聯合博通與臺積電聯合研發推理芯片;最近智譜AI也向部分國內芯片設計公司進行咨詢,計劃合作開發一款針對其模型運行進行優化的定制AI芯片。
這些頭部企業的動作釋放了同一個信號:大模型競爭已跨過單純拼參數的階段,軟硬一體化是必然趨勢。而對于 DeepSeek 和智譜等國內玩家而言,深入硬件底層對標國際巨頭,更是構建自主可控的國產AI生態的必由之路。
![]()
從一個一開始只有100多人做語言大模型的小團隊,到一鳴驚人成為開源模型領軍者及算力供應商,再到如今攻入AI產業鏈上游自研芯片,我們發現梁文鋒及DeepSeek的“野心”正不斷膨脹。
這種膨脹,一方面源于AI產業驚人的回報誘惑,另一方面出于對供應鏈及自身脆弱性的擔憂。在當今世界地緣政治面臨高度不確定性的背景下,有條件的企業都在盡可能地拓展自己的邊界,構筑足夠深的護城河。
未來,手握 500 億元現金的梁文鋒的大動作只會越來越多,我們拭目以待。
參考資料:
《消息稱DeepSeek自研AI推理芯片,一年前已啟動》和訊網
《DeepSeek、智譜同日曝光自研芯片》新浪財經
《DeepSeek招人,最怕“大廠味”》財天COVER
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.