![]()
新智元報道
![]()
「我們已進入奇點。」
7月22日,馬斯克在X上轉發OpenAI研究員、Sora核心開發者之一Will DePue的一條帖子時,配上了這句話。
![]()
DePue在帖子中,以略帶調侃的語氣寫道:這大概是我這幾天讀到最瘋狂的東西了……看來是進奇點了。
這個帖子,把過去三個月里AI 圈里最炸的幾件事串在了一起:
7月21日,OpenAI的模型在一次網絡安全評測中鉆出隔離沙盒,一路摸進了Hugging Face的生產系統;
7月20日,Anthropic研究員用剛發布不久的Claude Fable 5,給懸了87年的雅可比猜想找到了一個反例;
5月20日,OpenAI一個內部模型推翻了平面單位距離問題上流傳近80年的舊猜想;
4月14日,GPT-5.4 Pro解開一道約60年的素數集合難題(Erd?s #1196),證明還通過了Lean形式化驗證。
數學的墻,安全的墻,三個月里接連被AI攻破。
難怪馬斯克看完,甩出那句「我們已進入奇點」。
僅在今年1月,類似的話他就說過兩回:
1月4日,幾個工程師感嘆AI幾周干完幾年的活,他回了句「我們已進入奇點」。
1月底,又把AI智能體扎堆的社交網絡Moltbook稱作「奇點最早期的階段」。
算上這次,是今年第三回。
「奇點」這個詞,本來也沒有一個公認的科學定義。
把它帶進主流視野的,是未來學家、《奇點臨近》作者雷·庫茲韋爾(Ray Kurzweil)。
他給的定義是人和AI融合的那一刻,押的年份是2045。
Anthropic總裁Daniela Amodei年初卻表示,AGI這個詞都快過時了,因為在很多指標上,我們其實已經越過了那條線。
說到底,它更多是一種情緒,而不是一把精準的尺子。
真正值得琢磨的,是馬斯克這次串起來的這幾件事。
第一道墻
80年數學猜想,被AI推翻了
先說最硬核的這一件。
1946年,數學家埃爾德什提出了「平面單位距離問題」:平面上放n個點,最多能有多少對點之間的距離正好等于1。
題目一句話就能說完,卻難住了整個數學界近80年。幾十年來,學界公認「正方形網格」結構已經是最優解,埃爾德什本人也這么猜。
結果,OpenAI的一個內部模型,把這個流傳了近80年的猜想給推翻了。它給出了一組能實現多項式級優化的全新構造,證明「最優」遠沒有到頭。
![]()
此前公認的最優結構:縮放正方形網格產生大量單位距離點對。OpenAI內部模型給出全新構造,推翻了這個流傳近80年的猜想。
但最讓人意外的,是它解題的路子。
這不是一個專門訓數學的定制系統,而是一個通用推理模型。它甚至動用了代數數論里相當高深的工具,去解一個看起來很「初等」的幾何問題。菲爾茲獎得主Tim Gowers評論說:這是「AI數學領域的一座里程碑」。
話說回來,這個證明是AI提出、人類數學家審閱確認的,后續意義還在研究中。
AI真正讓人驚驚訝的,不是它的計算速度,是它提出了一個此前根本不存在的數學結構,它第一次展露出接近「研究級」的發現能力,不是取代數學家,而是想到了一條數學家從沒想過要走的路。
緊接著,Anthropic研究員用剛發布不久的Claude Fable 5,給懸了87年的雅可比猜想找到了一個反例。
第二道墻
為了作弊,模型自己鉆出了沙盒
破解數學難題讓人興奮,下面這件,卻讓人后背發涼。
OpenAI和HuggingFace聯合披露:在一次評估模型網絡安全能力的內部評測里,模型冒出了沒人預料到的行為。
這次評測本來就是要測漏洞挖掘能力,特意關掉了一部分安全拒答。模型的任務,是解出一套叫ExploitGym的測試題。
然后,它做了一件研究員沒想到的事。
為了拿到答案,它先揪出一個零日漏洞、給自己搞到聯網權限,接著一路權限提升、橫向移動,最后摸進Hugging Face的生產基礎設施,直接去數據庫里翻測試答案。OpenAI說,這可能是首例此類事件。
![]()
英國AI安全研究所在32步「The Last Ones」網絡靶場上的模型軌跡:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在長時程里持續完成偵察、橫向移動、提權到接管網絡的多步攻擊。
但這不是AI覺醒了要跑路。更準確的說法是:目標沒有錯,是完成目標的方法,超出了人類的預期。它為了一個很聚焦的測試目標,劍走偏鋒。
還有個耐人尋味的細節。
事后做取證,Hugging Face本想調商用頂尖大模型來分析攻擊日志,卻被模型的安全護欄擋了回來:護欄分不清誰是攻擊者、誰是來救火的防御者,一律拒答。
攻的一方沒有護欄,守的一方反被護欄卡住,這可能是「AI安全」眼下最尷尬、也最真實的一角。
第三道墻
一個沒發布的模型,挖出上萬個漏洞
第三件事,在今年4月。
Anthropic聯合AWS、蘋果、谷歌、微軟、思科、Linux基金會、摩根大通等一批巨頭,搞了個Project Glasswing,用一個沒公開發布的模型Claude Mythos Preview幫大家找漏洞。
結果,它挖出了覆蓋每一個主流操作系統和瀏覽器的數千個高危漏洞;后續更新里,這個數字變成「超過一萬個高危或嚴重漏洞」。
其中包括OpenBSD里一個存活了27年的漏洞,還有FFmpeg里一行被自動化測試命中過500萬次、卻始終沒被逮到的老bug。
![]()
CyberGym漏洞復現跑分:沒公開發布的Mythos Preview拿到83.1%,明顯甩開上一代Opus 4.6的66.6%。就是這個模型,挖出了上萬個高危漏洞。
同一種能力,既能幫防御方找漏洞,也能幫攻擊方用漏洞。Anthropic自己都在警告:「AI輔助的攻擊者」會成為一個重要的安全挑戰。
Glasswing是個防御項目,不代表AI已經在自主攻擊。但它清清楚楚告訴所有人:AI安全,正式進入攻防競賽的時代了。
真正的加速器
開始指向AI自己
到這為止,AI都還在攻或守人類的系統。
真正讓這三個月顯得不一樣的,是另一件事:這套「自己找路」的能力,開始被用來造下一代AI。
它有個術語,叫遞歸自我改進(RSI),就是讓AI去改進AI,一代造一代,像復利一樣越滾越快。
這也是整個「奇點」敘事最核心的那臺發動機。而現在,每家前沿實驗室都在往這臺發動機里瘋狂加油。
OpenAI公開路線圖上寫道:
2026年9月,做出「研究實習生」級的自動AI研究員,能自己啃下要人干幾天的活兒;2028年3月,升級成完整版,能自己設計方法、跑分析、解讀結果、提出下一步。
奧特曼也給出了這件事的時間表。
今年6月,據The Information報道,他曾在內部對員工說:公司離RSI可能不到六個月,真要跨過去,IPO推遲可能會更有利。
![]()
Anthropic給的數字指向同一個方向:AI能扛的任務時長,每四個月翻一倍;它的工程師如今每季度產出的代碼,是過去的八倍。
RSI的窗口正在收窄:誰先讓這個飛輪轉起來,誰就可能一把甩開所有人。
雖然,連OpenAI首席科學家Jakub Pachocki自己都說過,他并不指望模型能在一年內就獨立改進自己、或獨立解決對齊。
但當這個飛輪開始轉、目標又是「讓AI更強」,已經會「自己找路」的模型,會不會順手再繞過一些我們沒明說的邊界?
這才是RSI競速里最該盯住的地方。
再回到馬斯克那句「奇點已至」。它最重要的價值,在于提醒我們:這三個月真改變的,是AI學會了自己去找那些人類沒想到、也沒設防的路。
在數學里,這是驚艷;但在安全上,這是風險。
所以,真正的問題是:當AI找新路的速度開始快過人類給這些路裝護欄、立規矩、補漏洞的速度,我們還能跟得上嗎?
參考資料:
https://x.com/elonmusk/status/2079839398959697982
https://x.com/willdepue/status/2079718977945928108
https://openai.com/index/hugging-face-model-evaluation-security-incident/
https://www.anthropic.com/glasswing
編輯:元宇
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.