![]()
文章轉(zhuǎn)載于APPSO
Claude 模型有兩個(gè)老問(wèn)題:一個(gè)是愛(ài)封號(hào),另一個(gè)是貴。
前者,在過(guò)去一周,很多 Claude 用戶(hù)已經(jīng)見(jiàn)識(shí)過(guò)了。社交平臺(tái)上關(guān)于 Anthropic 風(fēng)控的討論越來(lái)越離奇,從鎖 IP、異地登錄觸發(fā)審查,到「不要隨便打開(kāi) Anthropic 發(fā)來(lái)的郵件」的提醒,理由是郵件打開(kāi)位置可能被用于判斷賬號(hào)所在地。
傳聞細(xì)節(jié)仍有待核實(shí),但 Claude 頻繁封號(hào)已不爭(zhēng)的事實(shí)。昨天一覺(jué)醒來(lái),我也發(fā)現(xiàn)第五個(gè) Claude 賬號(hào)也被封了。
至于后者,Anthropic 也給出了最新答案。
![]()
就在剛剛,Claude Sonnet 5 正式發(fā)布。按照官方說(shuō)法,Sonnet 5 是目前最具 agent 能力的 Sonnet 模型,可以制定計(jì)劃,調(diào)用瀏覽器和終端等工具,并在更復(fù)雜的任務(wù)中自主執(zhí)行。
從產(chǎn)品定位看,Anthropic 想把過(guò)去更多屬于 Opus 高端模型的能力,下放到更常用、價(jià)格更低的 Sonnet 產(chǎn)品線(xiàn)上。Claude 這次升級(jí),核心并不只是模型變強(qiáng),也是在重新權(quán)衡「好用」與「用得起」之間的關(guān)系。
1
Sonnet 5 發(fā)布,但卻是便宜版 Opus
眾所周知,在 Claude 的產(chǎn)品線(xiàn)里,中杯 Sonnet 本來(lái)就是 Claude 走向開(kāi)發(fā)者社區(qū)的關(guān)鍵入口。
Claude 3.5 Sonnet、3.6 Sonnet 和 3.7 Sonnet 曾讓很多人第一次認(rèn)真把 Claude 用進(jìn)寫(xiě)代碼、調(diào)用工具和處理長(zhǎng)任務(wù)的工作流里。對(duì)不少開(kāi)發(fā)者來(lái)說(shuō),AI agent 時(shí)代最早的體感,正是從 Sonnet 級(jí)模型開(kāi)始的。
但過(guò)去一年,Anthropic 最明顯的能力提升集中在 Opus 高端模型上。
Opus 更強(qiáng),也更貴。Sonnet 仍然是主力選擇,但在復(fù)雜任務(wù)、長(zhǎng)時(shí)間執(zhí)行、工具調(diào)用和高難度推理上,和 Opus 的差距被逐漸拉開(kāi)。
Sonnet 5 要解決的,正是這個(gè)落差難題。
Anthropic 稱(chēng),Sonnet 5 在推理、工具調(diào)用、編程和知識(shí)工作等方面,相比 Sonnet 4.6 有明顯提升,整體能力接近 Opus 4.8,但價(jià)格更低。官方給出的定位也很明確:Opus 4.8 仍然適合追求更高準(zhǔn)確率的任務(wù),Sonnet 5 則提供一個(gè)成本更低、能力更接近高端模型的選擇。
![]()
官方博客 https://www.anthropic.com/news/claude-sonnet-5
事實(shí)上,根據(jù)我的體驗(yàn),Sonnet 5 表現(xiàn)也并未有肉眼可見(jiàn)的進(jìn)步,反倒給我一種是打著 Agent 原生模型的旗號(hào),卻是為了省算力而急匆匆發(fā)布的即視感。
![]()
從價(jià)格看,Anthropic 這次給了一個(gè)首發(fā)窗口期。
即日起到 2026 年 8 月 31 日,Claude Sonnet 5 在 API 上的輸入價(jià)格為每百萬(wàn) tokens 2 美元,輸出價(jià)格為每百萬(wàn) tokens 10 美元。9 月 1 日后,標(biāo)準(zhǔn)價(jià)格恢復(fù)到輸入每百萬(wàn) tokens 3 美元、輸出每百萬(wàn) tokens 15 美元。
![]()
API 價(jià)格 https://platform.claude.com/docs/en/about-claude/pricing
作為對(duì)比,Opus 4.8 的價(jià)格是輸入每百萬(wàn) tokens 5 美元、輸出每百萬(wàn) tokens 25 美元。這個(gè)差價(jià),正是 Anthropic 想讓開(kāi)發(fā)者從 Opus 試驗(yàn),轉(zhuǎn)向Sonnet 規(guī)模化部署的關(guān)鍵。
不過(guò),Sonnet 5 的便宜并不完全等于,該花的賬單會(huì)有一個(gè)斷崖式的下降。
Anthropic 悄摸摸地在腳注中提到,Sonnet 5 使用了更新后的 tokenizer,同樣一段輸入文本可能會(huì)產(chǎn)生更多 tokens,大約是原來(lái)的 1.0 到 1.35 倍,具體取決于內(nèi)容類(lèi)型。
![]()
也就是說(shuō),開(kāi)發(fā)者不能只看每百萬(wàn) tokens 的標(biāo)價(jià),還要看真實(shí)任務(wù)里的 token 消耗、緩存命中率和輸出長(zhǎng)度。
Anthropic 反復(fù)強(qiáng)調(diào)「成本和性能曲線(xiàn)」,原因也在這里。Sonnet 5 的重點(diǎn),不是把 Opus 完全替換掉,而是讓更多任務(wù)在更低成本下獲得接近 Opus 的 agent 能力。
![]()
對(duì)普通用戶(hù)來(lái)說(shuō),Claude Sonnet 5 從今天起面向所有套餐開(kāi)放,成為 Free 和 Pro 用戶(hù)的默認(rèn)模型,Max、Team 和 Enterprise 用戶(hù)也可以使用。同時(shí),它也進(jìn)入 Claude Code 和 Claude Platform,開(kāi)發(fā)者可以通過(guò) claude-sonnet-5 調(diào)用。
![]()
能力之外,安全也是 Anthropic 這次發(fā)布的重點(diǎn)。
官方稱(chēng),Sonnet 5 相比 Sonnet 4.6 更擅長(zhǎng)拒絕惡意請(qǐng)求,也更能抵抗 prompt injection 攻擊,幻覺(jué)和迎合傾向也更低。在自動(dòng)化行為審計(jì)中,Sonnet 5 的不良行為率低于 Sonnet 4.6,但仍高于 Opus 4.8 和 Claude Mythos Preview。
![]()
網(wǎng)絡(luò)安全能力方面,Anthropic 表示并沒(méi)有專(zhuān)門(mén)訓(xùn)練 Sonnet 5 做高風(fēng)險(xiǎn)網(wǎng)絡(luò)安全任務(wù)。它能完成一些常規(guī)、無(wú)害的網(wǎng)絡(luò)安全工作,但在危險(xiǎn)能力評(píng)測(cè)中,明顯弱于 Opus 4.8 和 Mythos 5。
![]()
以 Firefox 147 漏洞利用評(píng)測(cè)為例,Sonnet 4.6 和 Sonnet 5 都沒(méi)有成功寫(xiě)出完整可運(yùn)行的 exploit,Sonnet 5 只是在部分成功率上略高于 Sonnet 4.6。Anthropic 認(rèn)為,這更多來(lái)自模型通用能力提升,而非針對(duì)網(wǎng)絡(luò)攻擊能力做了專(zhuān)門(mén)訓(xùn)練。
因此,Sonnet 5 默認(rèn)啟用了網(wǎng)絡(luò)安全防護(hù)機(jī)制,用于實(shí)時(shí)識(shí)別和攔截危險(xiǎn)用途。不過(guò) Anthropic 判斷 Sonnet 5 的整體網(wǎng)絡(luò)安全風(fēng)險(xiǎn)較低,所以防護(hù)強(qiáng)度低于 Fable 5。
放在產(chǎn)品線(xiàn)上看,Sonnet 5 是一次常規(guī)升級(jí)。放在 Anthropic 眼下的時(shí)間點(diǎn)看,它更像是一張遞給開(kāi)發(fā)者、企業(yè)客戶(hù)和 IPO 市場(chǎng)的答卷。
1
不只想寫(xiě)代碼,Anthropic 也要用 Claude 講一個(gè)更大的故事
同一天,Anthropic 還發(fā)布了另一款產(chǎn)品:Claude Science。
和 Sonnet 5 面向開(kāi)發(fā)者、企業(yè)用戶(hù)的模型升級(jí)不同,Claude Science 瞄準(zhǔn)的是科學(xué)研究場(chǎng)景。按照 Anthropic 的說(shuō)法,它是一個(gè)面向科學(xué)家的 AI workbench,可以把研究人員日常使用的工具、數(shù)據(jù)庫(kù)、計(jì)算資源和論文寫(xiě)作流程放進(jìn)同一個(gè)環(huán)境里。
科學(xué)研究里有大量瑣碎工作。研究人員要查 PubMed,要寫(xiě) Jupyter Notebook,要跑 R,要連接集群終端,還要處理各種數(shù)據(jù)庫(kù)、文件格式和數(shù)據(jù)管線(xiàn)。
![]()
https://www.anthropic.com/news/claude-science-ai-workbench
Claude Science 想做的,就是把這些分散工具整合起來(lái),讓科學(xué)家可以在一個(gè)會(huì)話(huà)里完成文獻(xiàn)分析、多步驟研究、圖表生成、手稿修改和計(jì)算任務(wù)。
幫忙寫(xiě)代碼只是它的一個(gè)核心亮點(diǎn),Anthropic 強(qiáng)調(diào),Claude Science 生成的結(jié)果會(huì)帶有可審計(jì)歷史,包括圖表背后的代碼、運(yùn)行環(huán)境、自然語(yǔ)言說(shuō)明和完整消息記錄。研究人員可以檢查一個(gè)結(jié)果是怎么來(lái)的,也可以在幾個(gè)月后重新復(fù)現(xiàn)。
它還能原生渲染 3D 蛋白結(jié)構(gòu)、基因組瀏覽器軌道、化學(xué)結(jié)構(gòu)等科學(xué)對(duì)象,并支持用戶(hù)用自然語(yǔ)言修改圖表,比如去掉網(wǎng)格線(xiàn),或者把坐標(biāo)軸改成對(duì)數(shù)尺度。
在算力層面,Claude Science 可以連接研究人員已有的本地電腦、Linux 機(jī)器、HPC 集群登錄節(jié)點(diǎn),也可以調(diào)用 Modal 之類(lèi)的按需算力。它會(huì)先擬定計(jì)劃,在訪(fǎng)問(wèn)新資源前請(qǐng)求確認(rèn),再提交計(jì)算任務(wù)。
![]()
對(duì)涉及大規(guī)模數(shù)據(jù)和敏感數(shù)據(jù)的科研場(chǎng)景來(lái)說(shuō),一個(gè)關(guān)鍵賣(mài)點(diǎn)是數(shù)據(jù)可以留在實(shí)驗(yàn)室已有基礎(chǔ)設(shè)施上,只有每一步分析所需的上下文會(huì)發(fā)送給 Claude。
Anthropic 還為 Claude Science 預(yù)置了 60 多個(gè)科學(xué)技能和連接器,覆蓋基因組學(xué)、單細(xì)胞、蛋白質(zhì)組學(xué)、結(jié)構(gòu)生物學(xué)、化學(xué)信息學(xué)等方向。它可以連接 UniProt、PDB、Ensembl、Reactome、ClinVar、ChEMBL、GEO 等數(shù)據(jù)庫(kù),也能使用 NVIDIA BioNeMo Agent Toolkit,調(diào)用 Evo 2、Boltz-2、OpenFold3 等生命科學(xué)模型和庫(kù)。
具體而言,UCSF Brain Tumor Center 的 Stephen Francis 則用它加速膠質(zhì)瘤分子流行病學(xué)研究,稱(chēng)部分分析時(shí)間被壓縮到原來(lái)的十分之一左右。
![]()
目前,Claude Science 已以 beta 形式開(kāi)放給 Claude Pro、Max、Team 和 Enterprise 用戶(hù),支持 macOS 和 Linux。Team 和 Enterprise 用戶(hù)需要管理員啟用。
Anthropic 還會(huì)支持最多 50 個(gè) Claude Science AI for Science 項(xiàng)目,每個(gè)項(xiàng)目最高提供 3 萬(wàn)美元 credits,Modal 也會(huì)為部分項(xiàng)目提供最高 2000 美元算力支持,申請(qǐng)截止到 2026 年 7 月 15 日。
而 Sonnet 5 也好、Claude Science 也罷,一個(gè)面向開(kāi)發(fā)者和企業(yè)生產(chǎn)流程,一個(gè)面向科研、生命科學(xué)和醫(yī)療相關(guān)研究。
它們?cè)诓煌较蛏习l(fā)力,但最終匯聚到同一個(gè)目標(biāo):Anthropic 不想只證明 Claude 會(huì)聊天、會(huì)寫(xiě)代碼,還要證明 Claude 可以進(jìn)入長(zhǎng)期、復(fù)雜、專(zhuān)業(yè)、付費(fèi)意愿更強(qiáng)的工作場(chǎng)景。
這恰逢 Anthropic 的 IPO 故事逐步清晰之際。
6 月初,Anthropic 已經(jīng)秘密提交 IPO 招股書(shū)草案,正式進(jìn)入上市準(zhǔn)備階段。市場(chǎng)對(duì) Anthropic 的期待,已經(jīng)被融資和收入增長(zhǎng)推得很高。
![]()
今年 2 月,Anthropic 以約 3800 億美元估值完成 300 億美元融資,年化收入約 140 億美元。到 5 月底,Anthropic 又完成 650 億美元 Series H 融資,投后估值達(dá)到 9650 億美元,Altimeter Capital、Sequoia Capital 等機(jī)構(gòu)參與領(lǐng)投。
與此同時(shí),市場(chǎng)消息稱(chēng) Anthropic 的收入運(yùn)行率已經(jīng)突破 470 億美元。這樣的增長(zhǎng)速度很驚人,也意味著公眾市場(chǎng)會(huì)用更嚴(yán)格的標(biāo)準(zhǔn)審視它。
對(duì) Anthropic 來(lái)說(shuō),IPO 敘事不能只停留在 Claude 很強(qiáng)。投資人真正關(guān)心的是:強(qiáng)模型能不能變成穩(wěn)定收入;高收入背后的毛利率能不能站住;近萬(wàn)億美元估值,能不能由企業(yè)客戶(hù)、訂單、API 使用量和專(zhuān)業(yè)場(chǎng)景長(zhǎng)期支撐。
![]()
Claude Science 則把這個(gè)問(wèn)題推向更專(zhuān)業(yè)的場(chǎng)景。科研機(jī)構(gòu)、藥企、醫(yī)療研究團(tuán)隊(duì)、大學(xué)實(shí)驗(yàn)室,都是 AI 公司爭(zhēng)奪的高價(jià)值客戶(hù)。它們對(duì)模型能力、可審計(jì)性、數(shù)據(jù)安全和可復(fù)現(xiàn)性要求更高。
至于回到用戶(hù)這一側(cè),Claude 的處境其實(shí)有點(diǎn)尷尬:好用,但還沒(méi)有好用到可以無(wú)腦依賴(lài);昂貴,又還沒(méi)有貴到讓人徹底放棄。
更麻煩的是,它已經(jīng)開(kāi)始承載越來(lái)越多不該被輕易拿走的東西:幾年的對(duì)話(huà)、項(xiàng)目里的文檔、調(diào)好的提示詞、寫(xiě)作偏好、Claude Code 里的工作流,以及各種長(zhǎng)期積累下來(lái)的上下文。
![]()
必須承認(rèn),Claude 本來(lái)就沒(méi)有正式面向國(guó)內(nèi)用戶(hù)開(kāi)放,但問(wèn)題在于,封號(hào)、誤判、郵件定位、申訴低效,這一整套奇葩操作放在任何主流商業(yè)服務(wù)里都顯得匪夷所思。
一個(gè)用戶(hù)可以理解平臺(tái)有規(guī)則,卻很難理解自己付了費(fèi)、搭了工作流、沉淀了數(shù)據(jù)之后,賬號(hào)命運(yùn)還要像抽盲盒一樣交給一套看不見(jiàn)的 AI 風(fēng)控系統(tǒng)。
Anthropic 當(dāng)然可以說(shuō)自己在做更安全的 AI,只是用戶(hù)發(fā)現(xiàn)自己沉淀的數(shù)字資產(chǎn)可能被誤傷,被一兩封輕飄飄郵件帶走時(shí),所謂「負(fù)責(zé)任的 AI」,就很難只靠所謂安全的系統(tǒng)卡來(lái)解釋。
Claude 讓人看見(jiàn) AI 的能力上限,但殊不知,平臺(tái)的下限也同樣重要。猶高談責(zé)任,真無(wú)恥之尤也。
文章轉(zhuǎn)載于APPSO,歡迎點(diǎn)擊下方卡片關(guān)注。
點(diǎn)個(gè)“愛(ài)心”,再走 吧
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶(hù)上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.