聽雨 發(fā)自 凹非寺量子位 | 公眾號 QbitAI
突發(fā),GPT-5.6剛剛大降價!
最高立減80%!
![]()
入門款Luna直接打骨折,每百萬Token輸入價格從1美元降到0.2美元,輸出價格從6美元降到1.2美元。
換算成人民幣,相當于輸入價格從約6.8元降到1.35元,輸出價格從約40.6元降到8.1元。
定位「日常干活主力」的Terra也降價20%,輸入、輸出價格分別降到2美元和12美元。
換算成人民幣,分別約為13.5元和81.2元。
只有旗艦模型Sol,穩(wěn)坐原價,但推出了Fast mode,速度最高達到標準模式的2.5倍,加速不加價。
![]()
自Codex猛猛重置用量之后,降價也給立馬安排上了,OpenAI你是要卷死誰…
這價格戰(zhàn)直接白熱化了。
OpenAI表示,降價是因為GPT-5.6 Sol自己幫自己省了錢
- GPT-5.6 Sol參與自身改進,效率取得了飛躍式提升,故特此回饋新老用戶~
左腳踩右腳原地飛升這套,OpenAI你也是玩上了
![]()
兩款降價,一款加速
現(xiàn)在,GPT-5.6三款模型的API價格分別是:
- GPT-5.6 Luna:每百萬Token輸入0.2美元、輸出1.2美元;
- GPT-5.6 Terra:每百萬Token輸入2美元、輸出12美元;
- GPT-5.6 Sol:每百萬Token輸入5美元、輸出30美元。
![]()
降價之后,Luna屬于一手大跳水。
其輸入價格已經(jīng)和上一代GPT-5.4 nano持平,輸出價格甚至還便宜0.05美元
但兩款模型干的活不完全一樣,GPT-5.4 nano主要面向分類、信息抽取和排序等簡單高頻任務。
GPT-5.6 Luna則被OpenAI定位為一款面向成本敏感型工作負載的模型,可以調(diào)用工具、處理長上下文,執(zhí)行多步工作流。
簡單來說,OpenAI正在把支撐Agent干活的模型,賣到過去簡單小模型的價位
Terra相對克制,降價20%。
Sol則保持原價,新增了Fast mode,速度最高達到標準模式的2.5倍,價格則是標準模式的2倍,模型智能水平不變。
它還會取代此前的Priority Processing。原本使用priority標簽的API請求,可以自動切換到Fast mode。
官方表示,這輪調(diào)整也會進入Codex和ChatGPT Work。
訂閱價格不會下調(diào),用戶的額度總量也不會增加,但調(diào)用Terra和Luna時,消耗的額度將相應減少。
同樣一筆訂閱費,可以讓模型多干幾次活。
OpenAI還順手把ChatGPT和Codex CLI里的Auto-review模型從GPT-5.4換成了GPT-5.6 Luna。
Auto-review負責在后臺檢查代碼和修改結(jié)果,屬于典型的高頻Agent任務。
結(jié)合模型升級和Luna降價,OpenAI預計其成本將降至原來的約十分之一。
便宜模型不再只負責分類、抽取這些傳統(tǒng)「雜活」,而是開始進入代碼審查、后臺監(jiān)控等需要判斷和工具調(diào)用的環(huán)節(jié)。
目前三款模型的定位是:
預算敏感、調(diào)用量大的任務交給Luna;
普通日常工作交給Terra;
高難度任務繼續(xù)使用Sol;
如果連等待都嫌慢,再花一倍的錢購買速度。
GPT-5.6開始參與給自己降本
為啥突然降價?
OpenAI表示,原因是GPT-5.6 Sol參與了自家生產(chǎn)系統(tǒng)的優(yōu)化
它所提高的效率,進而轉(zhuǎn)變成了價格表上打折的數(shù)字。
具體而言,GPT-5.6 Sol重寫和優(yōu)化了部分生產(chǎn)環(huán)境GPU Kernel,設計并運行數(shù)百次Token生成實驗,還參與監(jiān)控訓練,在出現(xiàn)問題時介入。
最后成績也很突出:生產(chǎn)GPU Kernel優(yōu)化,讓GPT-5.6端到端服務成本下降20%;改進推測解碼,讓Token生成效率提升15%以上。
![]()
GPU Kernel可以理解為模型在GPU上執(zhí)行具體計算任務的底層程序。
模型本身不用變,只要這些程序?qū)懙酶咝В粔KGPU就能更快完成計算,處理更多請求,單次調(diào)用成本也會跟著下降。
推測解碼則是在生成答案時,先批量「猜」出接下來可能出現(xiàn)的Token,再交給主模型驗證。猜得越準,需要逐個生成和等待的步驟就越少。
兩項優(yōu)化都沒有降低模型能力,卻能讓同一個模型跑得更快、更便宜。
不過,這還不是GPT-5.6完全自主升級自己。
OpenAI特意強調(diào),整個過程仍然由人類主導。
模型可以寫代碼、跑實驗、監(jiān)控異常,但目標怎么定、結(jié)果能不能用、代碼是否進入生產(chǎn)環(huán)境,依然需要「Human in the Loop」。
OMT
最后,還有一個新變化。
這次降價有一個很具體的落點:Agent工作流
打折最狠的Luna,并不只是用來做分類、抽取的傳統(tǒng)小模型。
按照OpenAI的定位,它可以調(diào)用工具、執(zhí)行多步任務,主要面向高頻、成本敏感型工作負載。
因此,Luna降價80%,也是在降低Agent長期運行的門檻
讓原本因為成本太高而不能頻繁執(zhí)行的審查、驗證和監(jiān)控任務,有機會變成工作流里的常規(guī)步驟。
再結(jié)合GPT-5.6參與優(yōu)化自身生產(chǎn)系統(tǒng),一套新的循環(huán)出現(xiàn)了:
模型參與提高運行效率,成本下降;價格降低后,模型進入更多高頻工作流;調(diào)用規(guī)模擴大,再推動下一輪效率優(yōu)化。
OpenAI這套降價飛輪,已經(jīng)雛形初現(xiàn)。
這一通操作下來,現(xiàn)在壓力直接給到A社:
「輪到你了。」
![]()
[1]https://x.com/OpenAI/status/2082878156483219672
[2]https://x.com/sama/status/2082880720989532597
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.