![]()
本文來自微信公眾號: 山上 ,作者:山上團隊
脆弱的模型時代。
作者I薛星星
編輯I蔣澆
封面I Kimi
像所有AI行業人士一樣,月之暗面創始人楊植麟喜歡用“AI一天,人間一年”的說法形容AI的迅速迭代。對于剛剛發布的Kimi K3而言,似乎沒有什么形容比這句話更為貼切。月之暗面成立至今已有三年,但過去三年的所有積累可能都抵不上這三天的轟動。
自ChatGPT發布以來,中國AI行業有許多次震驚世界的時刻。一部分來自于真正的技術突破,一部分則是媒體與廠商們的自嗨,Kimi K3的發布似乎是唯一能與“DeepSeek時刻”相媲美的。
和去年年初DeepSeek-R1發布后美國芯片產業普跌類似,上周包括英偉達、博通以及美光在內的費城半導體指數重挫10%,創下自2025年4月以來最大單周跌幅,進入技術性熊市區間。媒體統計稱,72小時內美股AI板塊合計蒸發4700億美元,約超3萬億人民幣。
不止一家海外媒體及研究機構用諸如“DeepSeek 2.0”來形容Kimi K3。《財富》雜志稱這是“第二次DeepSeek沖擊”,《華爾街日報》強調Kimi加劇了華爾街芯片股拋售,彭博社則表示“Kimi顛覆了美國領先中國的傳統認知”。
恐慌的情緒不斷蔓延,甚至令OpenAI及Anthropic都備受質疑,因為一家中國開源模型的性能似乎已接近頂級閉源模型。二者本就處在上市前的關鍵節點,模型性能領先是他們獲得高估值以及高定價的關鍵。部分美國開發者已經在質疑為何還要為Calude和GPT付出這么多的價格。
過去幾日,Anthropic宣布為所有Max及Team Premium用戶開放Claude Fable 5,但限額50%,此前他們曾因算力問題而計劃完全從訂閱方案中移除這一模型。OpenAI則在上周多次重置Codex限額,甚至一度取消了5小時的用量限制。
很難說這些事件都是Kimi K3的沖擊所致。在此之前,半導體產業已經連續承壓數周,華爾街分析師們迫切需要為這輪下跌尋找一個足夠醒目、也容易理解的借口——境外勢力自然是萬能法寶。更不用說OpenAI及Anthropic本就處在激烈競爭之中,已經演變到大打價格戰的地步。
但這似乎并不影響美國科技行業對于Kimi K3的驚訝。即便Kimi承認自身總體性能仍落后于Claude Fable 5于GPT-5.6 Sol,諸多海外評測機構仍在測評對K3不吝贊美,排名往往位列前茅。
Arena.ai稱Kimi K3以1679分的成績獲得前端代碼競技場榜首,超越Claude Fable 5。這家機構表示,上次中國模型如此接近領先,還是2025年的DeepSeek-R1。
![]()
Arena統計中美AI對比
高昂的市場熱情下,連楊植麟都成為美國科技圈熱議的新偶像人物。大洋彼岸的人民群眾疑問為何他當年沒有留在美國,而是回到了中國。楊植麟的博士生導師不得不專門發文解釋,澄清楊回國并不是由于簽證或移民問題,而是他自己堅定要回去創業。
大模型行業仍然遵循著最簡單明了的優勝劣汰法則,只要性能足夠領先,價格就不是問題。即便K3模型的輸入及輸出價格均較上代K2.6模型均上漲超3倍有余,也顯著高于GLM-5.2及DeepSeek V4 Pro,已經是目前市面上最貴的國產模型,但Kimi依然遭遇了算力緊缺問題。
7月19日晚,Kimi宣布由于算力緊缺,自即日起暫停C端新用戶訂閱。他們同時調整了會員權益,將原本覆蓋Kimi網頁版、App以及Kimi Work的通用會員與Kimi Code會員拆分銷售。Kimi總裁張予彤稱,K3發布次日公司ARR創下歷史最大單日增幅。
![]()
Kimi官方推文
算力緊缺一定程度上或許也與K3模型自身的Token效率相關。在Artificial Analysis的評測中,K3完成整套測試輸出了1.3億個Token,接近同類模型平均水平的兩倍。更長的輸出通常意味著更高的推理成本,這可能進一步加重Kimi的算力壓力。
社交媒體上,也有不少開發者吐槽Kimi K3是Token消耗大戶,有人稱跑了15分鐘就已經耗盡了5小時的限額。
K3的出圈似乎再一次證明了AI時代模型的脆弱性。僅僅兩周之前,中國大模型市場最被人看好的還是已經上市的智譜。上半年智譜發布的GLM-5.2模型被譽為國產開源模型的驕傲,幾次大幅上調價格依然緊俏。上市半年來,智譜股價翻了24倍有余,總市值一度突破1.3萬億港元。
但從上周開始,智譜的神話似乎就已松動。上周五,智譜股價下跌28.49%,本周一再跌19.56%,兩個交易日股價累計下跌超4成,市值跌破5000億港元。
Kimi K3的領先可能也維持不了多久。7月19日,阿里巴巴發布Qwen3.8 Max預覽版,參數規模達2.4萬億,宣稱綜合能力在全球范圍內僅次于Claude Fable 5。馬斯克對外稱,擁有2萬億參數量的Grok新模型即將完成初步訓練,它可能在保持較高運行效率的同時超越Kimi。
K3發布當天,薩姆·奧爾特曼對外表示,他知道他們過去12個月并非最佳,這主要歸咎于他,但他們即將迎來迄今為止最好的12個月。“團隊正在做非常出色的工作,我相信你會對他們為你準備的驚喜感到非常滿意。”
![]()
芯片行業多年來一直奉行著摩爾定律,在成本大致不變的情況下芯片性能大約每18至24個月翻一倍。但就像AI行業人士常常掛在嘴邊的“AI一天,人間一年”的說法,AI時代的模型性能提升可能以周甚至天來計算。
去年谷歌的Gemini模型一度令薩姆·奧爾特曼在公司內拉響紅色警報,但現在Gemini更流行的稱謂是“北美豆包”。彭博社稱Gemini 3.5 Pro的發布時間已經推遲數月,因為模型在編程及代碼生成能力上未達預期。
剛剛完成首輪融資的DeepSeek被曝即將推出DeepSeek-V4模型的正式版,外界稱性能將逼近GPT-5.6,且繼續保持極高性價比的優勢。
過去的時代總在反復證明時間的重要。無論是PC互聯網還是移動互聯網,一家公司只要起步足夠早、跑得足夠快,就有機會趕在窗口關閉前建立先發優勢。而隨著用戶和市場規模不斷擴大,領先非但不會被稀釋,反而會持續放大,令后來者越來越難以追趕。
但在AI時代,優勢并不總是站在時間這一邊。所有的領先都建立在模型性能的迭代上,總有后來者不斷推出更新的模型,縮短與前者的差距。如果說互聯網時代最難追趕的是規模,那么AI最醒目的優勢就是模型。只是這種優勢的保質期,往往只有一個版本。
兩個交易日內股價連跌4成的智譜,今日盤中漲幅一度超35%。市場消息稱,智譜已落地1GW級國產AI算力數據中心建設。
競爭仍在繼續。
本內容由作者授權發布,觀點僅代表作者本人,不代表虎嗅立場。如對本稿件有異議或投訴,請聯系 tougao@huxiu.com。
本文來自虎嗅,原文鏈接:https://www.huxiu.com/article/4877026.html?f=wyxwapp
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.