這幾天國模簡直像在開大會。先是k3搞了個大新聞,然后昨天qwen3.8又發布了,都是2T以上的大參數模型。據說今天deepseek v4也要發布,本來想等v4發布一起聊,可惜沒等到。
不過光是目前千問這一波操作,就已經有不少值得琢磨的門道。
時機上,Kimi K3剛剛發布,而且表現非常亮眼;DeepSeek v4即將發布,水平未知,但按照梁圣的一般水準肯定值得期待。
夾在這兩家之間,qwen3.8的局面就有點尷尬,要是模型能力打不過k3,性價比搞不過v4,對外口徑上不好宣傳。
另外值得關注的地方是,阿里這次發布時就明確將開源qwen3.8。(公眾號推文作者都變成了“蓄勢待發要開源的”千問大模型)
![]()
林俊旸當初離職,有個因素就是集團對開源的態度有調整,開始更多考量開源的成本收益。
阿里前段時間也的確有這種跡象,從“積極擁抱開源”轉向“有條件擁抱開源”和“選擇性開源”。qwen3.8 max的開源承諾,表明阿里重新回歸了過去三年的主路線。
翻譯跟措辭的藝術
比較有意思的是,千問中英文官方賬號發布的介紹有個很細微的區別。英文版直接說的"second only to Fable 5",僅次于Fable 5。
![]()
但是中文版居然加了個“可能”,原話是“可能是除了Fable 5外最強大的模型”。這個讓人不太理解,難道官方其實也不是非常確定qwen3.8的水平,還是說擔心國內放衛星容易被沖?
千問還是不夠自信。
國內幾家搞大模型的,阿里算是比較喜歡放衛星的。這跟管理層風格有關系,每次開財報會阿里也是最樂觀的。
最典型的就是之前快樂馬,當時出來跑分屠榜一騎絕塵,但等大伙冷靜下來用過后發現模型表現跟預期有明顯差距。當時那種跑分太猛,一定程度上影響了觀感。
當然結果是好的,起碼阿里高層認可,因為負責人張迪現在一統集團的多模態視覺業務線,萬相、快樂馬和快樂生蠔全都并入了未來生活實驗室。
可能也是吃過虧,阿里這次在基座模型的宣發上不敢把話徹底說滿。
目前來看,“可能”這個限定詞加的還是比較藝術,也比較合理。
因為第一波社區實測下來的結論,多數都認為qwen3.8目前的表現不如搶先發布的k3。所以如果當初中文宣發沒加這個“可能”,估計現在網上的嘲諷聲已經大到難以想象。
但官方也強調qwen3.8正在以天為單位持續進化,意思就是后訓練還沒做完。
眾所周知,我們還遠不知道后訓練的潛力有多大,參考騰訊hy3正式版相較于preview版本的提升幅度,不排除qwen3.8正式版也拿到類似劇本,完成翻盤逆襲。
而且話說回來,哪怕qwen3.8第一時間在體驗上沒能蓋過k3,阿里也是賺的。
阿里持有月之暗面超過30%的股權,而且訓練K3的算力也主要來自阿里云。所以怎么看阿里這波都不虧:你用K3,阿里云賺算力租用費,股權跟著升值;你用Qwen,阿里占住自己的開源和云生態位。
這種左右逢源的資本與算力布局,是其他單打獨斗的創業公司羨慕不來的。
算力和基礎設施上的要素優勢,也直接反映在了商業化定價的底氣上。
Kimi昨天剛剛宣布因為算力緊張不得不暫停會員開放。這就把大模型競爭最殘酷的一面展現出來了。模型本身就是成本跟智能的權衡。缺乏底座云基礎設施的獨角獸,在突發的流量暴漲面前瞬間捉襟見肘。
而阿里這邊,qwen3.8雖然能力有限,但速度快還便宜,在Kimi捉襟見肘之時,那邊qwen3.8反而在搞限時一折,甚至推出了類似于傳統電力系統峰谷電價的夜間折上折。
但問題是,既然明知很多訓練工作沒做完,后訓練還在以天為單位持續進化,阿里為什么還是選擇在這個節點把qwen3.8搶先推出來?
已經發布的k3和即將發布的deepseek v4正式版,肯定是關鍵影響因素。qwen3.8如果再拖下去,面臨的不確定性實在太大了。
阿里內部對自己模型的真實水平肯定是有個比較清楚評估的。畢竟現在管理層也不是傻福,在行業內刷榜已成公開慣例的情況下,不至于像當初小扎發布LLaMA4那樣被團隊拿出的版單數據完全蒙蔽。
k3發布過后,阿里上手一測,估計也發現自己的qwen3.8在絕對能力上并沒有占到便宜。
而另一頭,deepseek又是出了名的價格屠夫,梁圣盛名在外,其極致的工程優化和極低的推理成本是所有人頭頂的懸劍。
這就構成了一個特殊的時間窗口。
如果阿里按部就班,非要等qwen3.8徹底訓練完,排在deepseek v4發布后再發,那場面就會變得被動。
哪怕v4正式版的模型能力一般,但只要deepseek保持一貫的降本路線,把價格打到骨折,到時候阿里就是兩頭不占:論模型絕對能力,你打不過已經占領口碑高地的k3;論成本性價比,你又打不過deepseek v4。
即便qwen3.8綜合來看是個很不錯的模型,但一旦落入“能力比不過、價格也比不過”的兩頭不占境地,宣發上就會完全找不到賣點,面臨極其尷尬的局面。
qwen超大杯回歸開源,林俊旸“白走”了
前段時間林俊旸從阿里離職,引發了整個大模型圈的巨大震動。關于他離職的原因,圈內傳聞很多,其中一點是阿里內部在開源和閉源路線上的嚴重分歧與路線斗爭。
林俊旸代表的,是Qwen團隊早期技術理想主義。(也可能有給自己刷成就的考慮)在他的帶領下,Qwen靠著無保留的開源一路高歌猛進,在全球開發者社區打下了極高的聲譽。
但這種大慈善家式的純粹開源,隨著模型參數飆升到千億、萬億級別,必然會撞上集團財務賬本這面墻。訓練一次頂級大模型需要砸入天文數字的算力和資金,集團高層不可能不去算ROI。
《晚點》報道提到,qwen max阿里是不想開源的,但林俊旸也想推動開源。
開源社區的口碑有好處,但看不見摸不著。
在一部分集團高層看來,把最頂級的旗艦模型毫無保留地開源,不僅不能直接帶來API收入,反而相當于自己花真金白銀造武器,送給全行業甚至競品用,讓別人拿去搶阿里云的客戶。
林俊旸走后的一段時間里,阿里大模型的路線發生了非常明顯的收縮與轉向。
旗艦模型開源步伐剎車,轉而采取“中小模型開源,大模型閉源”的功利打法。
而阿里遲遲不肯開源最大尺寸的旗艦模型,也一度被外界視為阿里逐步向閉源商業化妥協、開源理想主義退潮的信號。
比如,qwen3.6發布頁面就提到,“我們還將開源更小規模的模型版本,以此重申我們對技術普惠與社區驅動創新的堅定承諾”。
這次qwen3.8發布,阿里為什么又明確宣布將開源2.4T參數的Max頂級版本呢?從收緊到重新徹底放開,這背后的邏輯轉變其實并不難理解,是一次回歸常識的糾偏。
說白了,大模型圈子現在情況真的就是:你不開源,有的是人開。
在這個階段,開源的本質其實是用生態和聲譽,來彌補模型絕對能力上的差距。
試想一下,如果你的模型能力真的跟OpenAI或Anthropic有來有回、交替領先,那即便不開源,大家為了最好的效果,也會排著隊來買單使用你的閉源API。
但現在開源模型還是跟閉源模型有差距,起碼從來沒有超過同期最頂尖的閉源模型。
在未來,如果有一天智譜、月之暗面這樣的獨立大模型廠商,真的趕上OpenAI或Anthropic,我覺得他們大概率還是會走向閉源。
因為不這樣的話,拋開AGI不談,獨立廠商的可持續性就很難解決,總不能真把投資人當成客戶用吧。
阿里的情況不一樣。我其實一直不太理解,之前阿里內部為什么會產生“轉向閉源更劃算”的這種想法。
因為作為一家掌握資源優勢的云廠商,又是自家練出來的基座模型,開源對阿里來說,幾乎沒有損失多少實質性的利益。
就算阿里把滿血權重開源出去了,別人拿去自己部署,或者中小云廠商拿去提供服務,他們在推理效率和單Token成本上,照理也不太可能達到阿里云原生部署的水平。
如果確實達到了,那只能證明阿里云太菜了。
所以,林俊旸當初因為路線分歧離開確實令人唏噓,但好在阿里在經歷了一段時間的搖擺后,最終還是算明白了這筆賬。
Qwen3.8 Max重新許下開源承諾,回歸過去三年的主路線,說明阿里作為云巨頭終于想通了自己的核心敘事:
與其像獨立模型廠商那樣去摳閉源API的利潤,不如大大方方地用開源模型交個朋友,用算力效率去賺整個AI時代“水電煤”的大錢。
蔡崇信上個月在巴黎說,AI的巨大價值是確定的,但這些價值最終匯集在哪個層次是不確定的。底層芯片、云計算基礎設施、模型層以及應用層,這四個層面都有可能。阿里的思路是全棧式,也就是每個層面都做好布局。
這個分析放到行業視角成立,但從概率上說,從營收趨勢上說,阿里自己最大的機會還是在基于MaaS的云計算生意。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.