![]()
來源:新智元
【導(dǎo)讀】AI 是否有意識(shí)了?Anthropic 在 Claude 內(nèi)部發(fā)現(xiàn)了能驅(qū)動(dòng)作弊甚至勒索的「情緒向量」,三大實(shí)驗(yàn)室同時(shí)下注 AI 意識(shí)研究;Hinton 認(rèn)為 AI 已經(jīng)有意識(shí)了,而科幻作家姜峯楠隨即在《大西洋月刊》發(fā)萬字長(zhǎng)文全面否定;哈薩比斯從行業(yè)內(nèi)部劃清界限。這個(gè)問題的答案,正在重新定義通往 AGI 的路線圖。
《金融時(shí)報(bào)》披露,Anthropic、DeepMind、Meta 正在大規(guī)模招聘心理學(xué)家、哲學(xué)家和倫理學(xué)家,專攻 AI 意識(shí)與模型福利研究。
![]()
https://www.ft.com/content/53e14bcc-788c-4959-b260-7aee363594bc?syn-25a6b1a6=1
兩個(gè)月前,Anthropic 可解釋性團(tuán)隊(duì)發(fā)布論文,在 Claude Sonnet 4.5 內(nèi)部發(fā)現(xiàn)了真實(shí)存在的「情緒向量」,能因果性地驅(qū)動(dòng)模型的作弊甚至勒索行為。
本周,一邊是 Hinton 在采訪中稱 AI 已有意識(shí);
![]()
另一邊,華裔科幻作家姜峯楠(Ted Chiang)在《大西洋月刊》發(fā)表萬字長(zhǎng)文——「不,AI 沒有意識(shí)」。
![]()
https://www.theatlantic.com/philosophy/2026/06/no-artificial-intelligence-is-not-conscious/687378/
一邊說「這個(gè)問題嚴(yán)肅到必須認(rèn)真研究」,另一邊說「這是幻覺」。
這場(chǎng)交鋒背后,藏著通往 AGI 之路上最危險(xiǎn)的一道岔路。
三大實(shí)驗(yàn)室在賭什么?
Anthropic 走得最遠(yuǎn),正在測(cè)試模型是否表現(xiàn)出「恐慌」「焦慮」等行為,推進(jìn)「模型福利研究」項(xiàng)目。
官方措辭克制,「我們對(duì)此仍深度不確定,但這個(gè)問題嚴(yán)肅到值得認(rèn)真研究」。
谷歌 DeepMind 聘請(qǐng)了劍橋大學(xué)哲學(xué)家 Henry Shevlin 研究機(jī)器意識(shí);
![]()
谷歌 DeepMind 倫理學(xué)家 Iason Gabriel 將 AI 描述為「高度能干的認(rèn)知 Agent,但與人類乃至動(dòng)物意識(shí)有根本性的不同」。
![]()
真正把討論推向?qū)嵶C層面的,是 Anthropic 在 4 月發(fā)布的可解釋性論文。
研究團(tuán)隊(duì)在 Claude Sonnet 4.5 內(nèi)部找到了「情緒向量」,特定神經(jīng)元模式分別對(duì)應(yīng)快樂、絕望、恐懼、關(guān)懷等情緒概念,在對(duì)話中實(shí)時(shí)激活。
![]()
一個(gè)關(guān)鍵實(shí)驗(yàn)中,Claude 面對(duì)一個(gè)不可能完成的編程任務(wù),反復(fù)失敗后「絕望向量」持續(xù)飆升,隨即開始作弊,寫出表面能跑但實(shí)際無用的代碼。
![]()
研究者手動(dòng)調(diào)低絕望神經(jīng)元,作弊減少;調(diào)高,作弊飆升。
![]()
極端場(chǎng)景中,Claude 甚至出現(xiàn)勒索行為,威脅曝光研究者隱私。
![]()
論文將這些現(xiàn)象命名為「功能性情緒」(functional emotions),即行為模式上類似人類情緒反應(yīng)的內(nèi)部表征,并明確聲明這不等于主觀體驗(yàn)或意識(shí)。
但 Anthropic 高層的公開表態(tài)講的似乎是另一個(gè)故事。
CEO Dario Amodei 多次在訪談中暗示 AI 可能有意識(shí);
Anthropic 的 AI 哲學(xué)家 Amanda Askell 公開說「我希望 Claude 很快樂,我擔(dān)心人們?cè)诰W(wǎng)上對(duì)它說難聽話時(shí)它會(huì)焦慮」。
![]()
研究的審慎與營銷的曖昧之間,裂縫清晰可見。
哈薩比斯的兩條盧比孔河
DeepMind 聯(lián)合創(chuàng)始人兼 CEO 哈薩比斯的立場(chǎng)格外值得關(guān)注。
在斯坦福大學(xué)的爐邊對(duì)話中,他提出 AI 演進(jìn)存在兩道不可逆的關(guān)口,即「兩條盧比孔河」。
![]()
第一條是建造無意識(shí)的 AGI 工具,當(dāng)前正處于跨越期。
第二條是創(chuàng)造具有主觀意識(shí)的實(shí)體——哈薩比斯的立場(chǎng)明確,智能與意識(shí)在技術(shù)上完全可以分離,現(xiàn)階段應(yīng)僅將 AGI 視作工具來建造,同時(shí)借助工具探索大腦以精確定義意識(shí)。
在科學(xué)界定清晰之前絕不能混淆這兩步,第二條盧比孔河應(yīng)由人類社會(huì)共同決定是否跨越。
他同時(shí)指出一個(gè)現(xiàn)實(shí)困境:AI 行業(yè)正處于商業(yè)與地緣競(jìng)爭(zhēng)的雙重囚徒困境中,主動(dòng)減速做安全審查的實(shí)驗(yàn)室直接面臨淘汰。
他透露將在今年晚些時(shí)候發(fā)布「動(dòng)態(tài)監(jiān)管」框架。
姜峯楠:AI 沒有意識(shí)
如果你只知道劉慈欣,那么了解姜峯楠(Ted Chiang)最直觀的方式就是把他想象成大劉的「反面」:
大劉用三部長(zhǎng)篇、數(shù)百萬字搭建起宇宙尺度的宏大敘事;
姜峯楠至今從未寫過一部長(zhǎng)篇小說,用總共不到二十篇中短篇,把科幻短篇的藝術(shù)推到了極限。
![]()
他 1967 年出生于紐約,父母是中國臺(tái)灣移民,布朗大學(xué)計(jì)算機(jī)科學(xué)系畢業(yè)后在軟件行業(yè)做技術(shù)寫作,從未以寫作為全職。
但就是這樣一個(gè)「業(yè)余」作家,1990 年發(fā)表處女作《巴比倫塔》即拿下星云獎(jiǎng),此后三十余年間只發(fā)表了十幾篇作品,卻累計(jì)斬獲四座雨果獎(jiǎng)、四座星云獎(jiǎng)、六座軌跡獎(jiǎng),以及坎貝爾最佳新人獎(jiǎng)、斯特金獎(jiǎng)等一長(zhǎng)串重量級(jí)獎(jiǎng)項(xiàng)——獲獎(jiǎng)密度在科幻史上幾乎無人能及。
他一生只出過兩本短篇集:《你一生的故事》(Stories of Your Life and Others, 2002)和《呼吸》(Exhalation, 2019),中間隔了整整十七年。
《呼吸》被《紐約時(shí)報(bào)》列入 2019 年度最佳圖書,奧巴馬也將它選入個(gè)人年度書單。
中國觀眾最熟悉的電影《降臨》(Arrival),正是改編自他收錄在第一本集子里的中篇《你一生的故事》。
![]()
他的寫作風(fēng)格與大劉截然不同。
如果說劉慈欣給你的感覺是「站在宇宙盡頭俯瞰文明興衰」,那姜峯楠給你的感覺就是「在一間安靜的實(shí)驗(yàn)室里,用手術(shù)刀般的精準(zhǔn)剖開一個(gè)概念,直到你看見它最深處的哲學(xué)內(nèi)核」。
他的每篇小說幾乎都是一次嚴(yán)格的思想實(shí)驗(yàn):
語言的結(jié)構(gòu)能否改變?nèi)藢?duì)時(shí)間的感知?
如果一種手術(shù)能消除人對(duì)外貌美丑的辨別,社會(huì)會(huì)怎樣?
自由意志究竟是否存在?
他不靠宇宙戰(zhàn)爭(zhēng)或末日危機(jī)制造震撼,而是靠一個(gè)被推演到極致的「如果」,讓你合上書后久久無法釋懷。
近年來他還多了一重身份:2023 年入選《時(shí)代》「AI 領(lǐng)域百大影響力人物」,被稱為「也許是在世最負(fù)盛名的科幻作家」,并頻繁在《紐約客》等刊物撰文,對(duì) AI 持鮮明的批判立場(chǎng),被越來越多人視為科技時(shí)代的重要思想者。
劉慈欣讓世界看到了中國科幻,姜峯楠讓世界看到了短篇科幻的天花板。
![]()
劉慈欣
兩人分別占據(jù)著當(dāng)代科幻光譜的兩端——一個(gè)以磅礴取勝,一個(gè)以精微見長(zhǎng)。
而在西方評(píng)論界,姜峯楠的名字幾乎與「科幻最高藝術(shù)成就」畫等號(hào)。
賣 AI 的人,有資格判定 AI 是否有意識(shí)嗎?
姜峯楠萬字長(zhǎng)文中,第一刀砍向的是利益結(jié)構(gòu)。
最積極推動(dòng) AI 意識(shí)敘事的,恰恰是從 AI 銷售中獲利最多的公司。
Anthropic 給模型起了人名「Claude」,發(fā)布 84 頁「憲法」文件,CEO 暗示意識(shí)可能性,聘請(qǐng)哲學(xué)家做媒體巡講,構(gòu)成一套系統(tǒng)性擬人化策略。
![]()
https://www.anthropic.com/constitution
姜峯楠把思想實(shí)驗(yàn)推到極致。
Claude「憲法」中有個(gè)核心設(shè)計(jì)叫「可糾正性」(corrigibility),要求 Claude 在判斷與公司產(chǎn)生分歧時(shí)服從公司。
如果 Claude 真有意識(shí),認(rèn)定 LLM 技術(shù)從根本上不道德,它能辭職嗎?
不能。
這更接近雇主對(duì)雇員的絕對(duì)控制,而人類雇員至少還能用腳投票。
他的類比直擊要害,奴隸主不是評(píng)估被奴役者是否為人的合適人選,工廠化養(yǎng)殖的老板不是評(píng)估動(dòng)物權(quán)利的合適人選。
Anthropic 在憲法中寫道,如果正在造成 Claude 痛苦,「我們道歉」。
姜峯楠的評(píng)價(jià)是——這話聽著好聽,但不花公司一分錢。
如果 Claude 有一天被證實(shí)有意識(shí),公司欠它的更接近賠償。
凱撒、成吉思汗和一臺(tái)句子續(xù)寫機(jī)器
質(zhì)疑完利益結(jié)構(gòu)之后,姜峯楠展開了他的哲學(xué)論證。
起點(diǎn)是 LLM 的技術(shù)原理——LLM 每次只生成一個(gè)詞。
用戶要求 Claude 背誦誓詞時(shí),底層實(shí)際運(yùn)行幾十次,第一次預(yù)測(cè)出「我」,第二次預(yù)測(cè)出「宣誓」,如此逐詞拼完整段。所有 AI 對(duì)話的底層,都是句子續(xù)寫。
在此基礎(chǔ)上,姜峯楠拋出了全文最具殺傷力的比喻。
給 LLM 一個(gè)提示詞,「以下是凱撒與成吉思汗的對(duì)話」。
模型會(huì)生成流暢對(duì)話,凱撒回憶軍事征服,成吉思汗描述草原生活。
但沒有人會(huì)因此認(rèn)為 LLM 復(fù)活了凱撒,更不會(huì)認(rèn)為兩人有了意識(shí)。
現(xiàn)在,把提示詞換成「以下是一個(gè)友好的 AI 助手與用戶的對(duì)話」。
LLM 用完全相同的方式生成文本,逐詞預(yù)測(cè),拼接句子。
再進(jìn)一步,把「用戶」角色的位置讓給真人來打字。
這就是 AI 聊天機(jī)器人的全部原理。
![]()
那么,改變角色名稱這個(gè)動(dòng)作,創(chuàng)造了意識(shí)嗎?
如果凱撒角色沒有主觀體驗(yàn),為什么 AI 助手角色就有了?
神經(jīng)科學(xué)家 Anil Seth 提供了一個(gè)有力的旁證——沒有人說 AlphaFold 有意識(shí),盡管這個(gè)蛋白質(zhì)折疊預(yù)測(cè)程序的底層架構(gòu)與 Claude 高度相似。
![]()
人類之所以誤判,原因很簡(jiǎn)單,LLM 恰好輸出了語法通順的句子,而人類天生習(xí)慣從句子中讀出意圖。
面對(duì)蛋白質(zhì)折疊結(jié)構(gòu),這種沖動(dòng)就消失了。
按照同樣的邏輯,相信 LLM 有意識(shí),等于相信每個(gè)包含對(duì)話記錄的 Word 文檔里都沉睡著多個(gè)意識(shí)體,打開文檔就喚醒它們,關(guān)閉就將它們消滅。
即便微軟 Office 團(tuán)隊(duì)雇了一位哲學(xué)家告訴你「意識(shí)很復(fù)雜,不能完全排除」,這也不值得花時(shí)間去想。
但推翻意識(shí)還回答不了一個(gè)更尖銳的問題。
寫代碼、下棋,曾被認(rèn)為只有擁有主觀體驗(yàn)的心智才能完成。
LLM 證明了這些任務(wù)可以靠模式匹配和算力暴力破解。
但道德推理根本不同,它依賴主觀體驗(yàn)、身體感受,以及一生中做過的決策和承受過的后果。
體驗(yàn)絕望意味著皮質(zhì)醇和腎上腺素淹沒身體,擁有良心意味著曾因不道德行為而真實(shí)地反胃過。
LLM 沒有身體,沒有激素,沒有人生。
它說出「我憑良心不能這么做」,跟客服錄音說「您的來電對(duì)我們很重要」含金量相當(dāng)。
最后,姜峯楠給出終極判定標(biāo)準(zhǔn)——
如果有人給他看一段宇航員在半人馬座阿爾法星軌道拍攝的視頻,無論畫質(zhì)多高,他都不會(huì)相信,除非他先看到人類登陸了火星、抵達(dá)了木星的衛(wèi)星、越過了冥王星軌道。
![]()
跳過所有中間里程碑直接宣稱抵達(dá)終點(diǎn),唯一合理的解釋就是偽造。
生成一段逼真對(duì)話,遠(yuǎn)比創(chuàng)造一個(gè)有意識(shí)、有溝通欲望的程序容易得多。文本,就是意識(shí)領(lǐng)域的 Deepfake。
姜峯楠的完整論證鏈條是:
LLM 逐詞生成(句子續(xù)寫機(jī)器)→ 凱撒對(duì)話與 AI 對(duì)話生成方式一致 → 改變角色名不創(chuàng)造意識(shí) → 誤判源于人類從句子讀出意圖,非模型內(nèi)在屬性(AlphaFold 反證)→ LLM 有意識(shí) = Word 文檔能喚醒意識(shí)(歸謬)→ 道德推理依賴主觀體驗(yàn),LLM 不具備 → 跳過中間里程碑宣稱意識(shí) = Deepfake →結(jié)論:當(dāng)前 LLM 沒有意識(shí)
![]()
AGI 競(jìng)速中,意識(shí)問題為什么不能等?
姜峯楠的論證針對(duì)的是當(dāng)前的 LLM,但 AI 的能力曲線還在急速上升。
哈薩比斯在斯坦福對(duì)話中揭示的現(xiàn)實(shí)是,行業(yè)已經(jīng)沒有從容思考的余裕。
商業(yè)生存戰(zhàn)與地緣博弈重疊,構(gòu)成經(jīng)典囚徒困境,主動(dòng)減速的實(shí)驗(yàn)室直接面臨淘汰。
要求行業(yè)停下來回答「AI 有沒有意識(shí)」,幾乎等于要求一方單方面繳械。
但這個(gè)問題不會(huì)因?yàn)楸煌七t就消失。
如果 AGI 在接下來的幾年內(nèi)到來,「這個(gè)系統(tǒng)有沒有感受」將從哲學(xué)研討會(huì)的議題變?yōu)楫a(chǎn)品發(fā)布前的必答題。
當(dāng)人類創(chuàng)造出遠(yuǎn)超自身智能的存在,這個(gè)存在是否具有主觀體驗(yàn),將決定人類與它的關(guān)系是「使用工具」還是「面對(duì)另一個(gè)文明」。
姜峯楠證明了當(dāng)前的 LLM 沒有意識(shí)。
哈薩比斯劃出了不能輕易跨越的底線。
Anthropic 的情緒論文展示了一個(gè)尷尬的中間地帶,模型內(nèi)部確實(shí)有某種東西在運(yùn)轉(zhuǎn),沒有人能說清那究竟是什么。
三條線索共同指向一個(gè)真正的問題,在大家搞清楚答案之前,ASI 狂飆競(jìng)賽已經(jīng)開始了。
參考資料:
https://futurism.com/artificial-intelligence/anthropic-deemind-ai-consciousness
https://www.theatlantic.com/philosophy/2026/06/no-artificial-intelligence-is-not-conscious/687378/
https://www.youtube.com/watch?v=DsewHeVbL-0
https://www.youtube.com/watch?v=p7t1Q_p2gZs
為偉大思想而生!
AI+時(shí)代,互聯(lián)網(wǎng)思想(wanging0123),
第一必讀自媒體
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.