在特朗普政府罕見干預下,美國人工智能行業正面臨前所未有的監管壓力。7月初,白宮以“國家安全”為由,要求OpenAI推遲全面發布其最新大模型GPT-5.6https://www.toutiao.com/article/7655896228169679360/,并僅允許在初步預覽階段向經政府批準的“可信賴客戶”有限開放。這是美國歷史上首次提前干預本土AI公司模型發布,凸顯當局對前沿AI系統潛在網絡攻擊能力的深切憂慮。
然而,7月10日凌晨,OpenAI仍按原計劃舉行全球線上發布會,正式推出GPT-5.6模型家族及三大重磅產品更新——Agent辦公平臺ChatGPT Work、全新桌面客戶端、以及Hosted Sites(托管網站)服務,標志著公司在合規與創新之間走出了一條微妙平衡之路。
![]()
1.GPT-5.6三劍齊發:性能追平Claude,成本大幅領先
此次發布ter 的GPT-5.6系列包含三個層級:
GPT-5.6 Sol:旗艦模型,面向高復雜度任務,未來24小時內向所有付費用戶開放。家族中最高的推理天花板,最適合在龐大的代碼庫和要求較高的長期代理工作中進行復雜推理
GPT-5.6 Terra:日常任務主力,是日常互動和代理編碼的強有力選擇,向免費用戶開放。
GPT-5.6 Luna:一款輕量化、低成本的變體,適合更小、更快速的任務,也是家族中成本最低的選擇,同樣面向免費用戶。
據第三方評測平臺Artificial Analysis數據,GPT-5.6 Sol在“max推理強度”下得分為59分,僅比Anthropic的Claude Fable 5低1分;但在編程專項榜單上以80分反超Fable 5的77.2分。更關鍵的是成本優勢:Sol單任務平均花費僅1.04美元,不到Fable 5(2.75美元)的37%。
OpenAI內部基準顯示,在軟件工程與高等數學等專業領域,Claude Mythos 5和Fable 5仍具微弱優勢;但在Agent行為、計算機操作、聯網搜索等貼近真實工作流的場景中,GPT-5.6 Sol已實現全面追平甚至局部超越。
2.ChatGPT Work:真正的“數字同事”
本次發布會的核心并非模型本身,而是ChatGPT Work——一個對標Claude Cowork與Kimi Work的智能辦公Agent平臺。
它能自主執行端到端辦公任務:從信息搜集、數據分析、文檔撰寫,到Excel建模、PPT制作乃至網站生成。
更引人注目的是其深度集成能力:支持連接Slack、Gmail、Google Drive、企業數據庫等外部系統。
發布會上,OpenAI演示了一個典型用例:用戶輸入“幫我安排一次舊金山用戶訪談”,系統便自動查閱Slack歷史消息、篩選反饋積極的用戶、協調日程,并生成會議邀請——全程無需人工干預。
3.桌面端革命:Codex被整合,CompuUse上線
新版ChatGPT桌面應用迎來重大升級:
· 獲得訪問本地文件、瀏覽器標簽頁及部分桌面軟件的權限;
· 正式啟用Computer Use(計算機操作)功能,可模擬人類點擊、輸入、拖拽等操作;
· Codex獨立應用被取消,其功能整體并入ChatGPT桌面端,原有Codex應用將在更新后自動卸載。
此舉引發開發者社區強烈反彈。對此,OpenAI聯合創始人兼CEO Sam Altman迅速回應:“Codex不會消失,只是成為ChatGPT的一部分。”他強調,這一整合旨在統一開發體驗,避免工具碎片化。
此外,GPT-5.6新增多級推理強度選項:
· “max”模式支持更深邏輯鏈;
· 全新“ultra”模式可同時調度4個子智能體,以更高算力換取更強結果與更快響應——該功能目前僅限ChatGPT Work使用。
4.定價策略:普惠與高性能并行
OpenAI延續分層定價策略(按每百萬token計費):
· Sol:輸入30
· Terra:輸入15
· Luna:輸入6
這一結構既滿足企業級高精度需求,也為普通用戶提供低成本入口,進一步鞏固其在開發者與大眾市場的雙重優勢。
![]()
首席執行官Sam Altman承諾,公司最新的模型比以往版本高效。且更具成本效益,高出數量級,其中Sol在AI編碼任務中代幣效率提升了54%。
最值得注意的是,公司稱5.6為其“迄今為止最強的網絡安全模型,以顯著更少的代幣實現了前沿性能”。
OpenAI新宣布的系列模型緊隨本周競爭對手SpaceXAI和Meta發布的類似產品之后。
然而,GPT-5.6及其配套的營銷似乎更像是針對OpenAI的主要對手Anthropic。Anthropic成功地成為了AI競賽中受歡迎的黑馬,專注于企業客戶,并因此贏得了越來越多的支持。
OpenAI不甘示弱,引用了人工分析編碼代理指數(Artificial Analysis Coding Agent Index),這是一個重要的基準指標,聲稱其最新系列模型在各方面都超越了Anthropic的模型。
OpenAI稱Sol為其“迄今為止最好的編碼模型”,并明確將其與Anthropic最近發布且備受炒作的Fable進行了比較。OpenAI利用編碼代理指數稱,Sol“將新技術水平設定在80點,比《Fable 5》高出2.8個分點,同時使用不到一半的輸出代幣,耗時不到一半,成本也降低了大約三分之一。”
![]()
5.在監管紅線下推進AI民主化
事實上,關于該模型的網絡能力引發了廣泛討論,特朗普政府此前曾試圖限制其推廣,表面上是擔心該模型可能被濫用。GPT-5.6支持防御活動,包括威脅建模、代碼審查和修補,以及藍隊(模擬對自身系統發動攻擊,在真實黑客發現之前發現弱點)。
盡管面臨政府限制,OpenAI仍選擇在全球范圍內如期發布GPT-5.6,釋放出明確信號:技術演進不應因安全焦慮而停滯,而應通過可控部署與透明機制化解風險。隨著Agent能力從“輔助”邁向“自主執行”,人機協作的新范式已然開啟——而OpenAI,正試圖在這場變革中繼續領跑。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.