深度觀察
AI 公司之間的競(jìng)爭(zhēng),正在從參數(shù)、榜單和價(jià)格,進(jìn)入一個(gè)更敏感的領(lǐng)域:誰(shuí)學(xué)了誰(shuí)。
不追熱點(diǎn)本身,先看它改變了什么。
美國(guó) AI 公司 Anthropic 近日在給美國(guó)參議員的信中聲稱,疑似與阿里巴巴及其 Qwen 團(tuán)隊(duì)相關(guān)的操作者,通過大量虛假賬號(hào)訪問 Claude,試圖用 Claude 的輸出訓(xùn)練自己的模型。
按照 Anthropic 的說法,這場(chǎng)行動(dòng)在 2026 年 4 月到 6 月之間發(fā)生,涉及近 2.5 萬(wàn)個(gè)虛假賬號(hào)和約 2880 萬(wàn)次交互。
這類做法通常被稱為模型蒸餾。
簡(jiǎn)單說,就是讓一個(gè)更強(qiáng)的模型大量回答問題,再用這些回答訓(xùn)練另一個(gè)模型,讓后者復(fù)制前者的一部分能力。
阿里方面截至相關(guān)報(bào)道發(fā)布時(shí)尚未公開回應(yīng)。
所以,這件事首先仍然是一項(xiàng)指控,而不是已經(jīng)被法律確認(rèn)的事實(shí)。
但它暴露出一個(gè)更大的問題:AI 模型的知識(shí)產(chǎn)權(quán)邊界,正在變得越來越難劃清。
![]()
蒸餾為什么會(huì)變成爭(zhēng)議核心
模型蒸餾本身不是新概念。
在機(jī)器學(xué)習(xí)里,用大模型教小模型,一直是常見方法。
它可以降低部署成本,也可以讓小模型在特定任務(wù)上變得更實(shí)用。
真正有爭(zhēng)議的,是訓(xùn)練材料從哪里來。
如果一個(gè)公司用自己訓(xùn)練的大模型,給自己的小模型做蒸餾,這是內(nèi)部技術(shù)路線。
如果它通過公開 API、大量賬號(hào)或繞過限制的方式,持續(xù)抓取另一家公司的模型輸出,再拿去訓(xùn)練競(jìng)爭(zhēng)模型,性質(zhì)就完全變了。
這里的難點(diǎn)在于,AI 模型不像傳統(tǒng)軟件那樣容易證明復(fù)制。
代碼有沒有被抄,通常可以比對(duì)文件和函數(shù)。
模型能力有沒有被偷學(xué),卻更像判斷一個(gè)學(xué)生是不是看了別人的答案。
輸出風(fēng)格、推理路徑、錯(cuò)誤模式、特定題目的反應(yīng),都可能成為線索,但很難像軟件侵權(quán)那樣一錘定音。
這也是為什么 Anthropic 的指控重要。
它不是單純抱怨競(jìng)爭(zhēng)對(duì)手學(xué)得快,而是在推動(dòng)行業(yè)承認(rèn)一種新的知識(shí)產(chǎn)權(quán)形態(tài):模型能力本身也需要被保護(hù)。
為什么現(xiàn)在爆發(fā)
AI 行業(yè)過去兩年太燒錢了。
訓(xùn)練一個(gè)頂級(jí)模型,需要芯片、數(shù)據(jù)、電力、研究團(tuán)隊(duì)和長(zhǎng)期試錯(cuò)。
如果一家后來者可以通過調(diào)用領(lǐng)先模型,用較低成本復(fù)制一部分能力,那么領(lǐng)先者的研發(fā)投入就會(huì)被稀釋。
這對(duì) OpenAI、Anthropic、Google 這類公司都是威脅。
它們花了巨額成本搭出的能力,可能被別人通過輸出接口一點(diǎn)點(diǎn)“吸走”。
另一方面,中國(guó)模型追趕速度很快。
Qwen、DeepSeek、GLM 等模型不斷刷新外界對(duì)中國(guó) AI 能力的預(yù)期。
在美國(guó)監(jiān)管者眼里,這會(huì)被放進(jìn)更大的技術(shù)競(jìng)爭(zhēng)框架里。
所以,模型蒸餾不只是商業(yè)糾紛,也會(huì)迅速變成地緣科技議題。
誰(shuí)能訪問先進(jìn)模型,誰(shuí)能調(diào)用多少次,誰(shuí)的賬號(hào)算異常,都會(huì)被重新審視。
AI 公司以后可能不只賣 API,還要像銀行一樣做風(fēng)控。
它們要識(shí)別誰(shuí)是真正的開發(fā)者,誰(shuí)是在批量抽取能力。
![]()
誰(shuí)受益,誰(shuí)被擠壓
最先受益的,可能是 AI 安全和模型風(fēng)控公司。
未來每一家大模型平臺(tái)都需要更強(qiáng)的異常檢測(cè)能力。
同一個(gè)組織是否在拆分賬號(hào),同一批請(qǐng)求是否有系統(tǒng)性采樣意圖,輸出是否被用于訓(xùn)練競(jìng)爭(zhēng)模型,都需要被監(jiān)控。
大模型平臺(tái)本身也會(huì)調(diào)整商業(yè)規(guī)則。
免費(fèi)額度會(huì)變少,API 訪問會(huì)更嚴(yán)格,企業(yè)客戶認(rèn)證會(huì)更復(fù)雜。
這對(duì)普通開發(fā)者并不完全是好消息。
如果平臺(tái)為了防蒸餾而提高門檻,小團(tuán)隊(duì)調(diào)用先進(jìn)模型的成本和合規(guī)負(fù)擔(dān)都會(huì)增加。
被擠壓的還有開源模型生態(tài)。
很多開源模型的成長(zhǎng),確實(shí)離不開對(duì)強(qiáng)模型輸出的學(xué)習(xí)、評(píng)測(cè)和對(duì)齊。
如果行業(yè)把所有“向強(qiáng)模型學(xué)習(xí)”的行為都視為可疑,開源社區(qū)會(huì)受到寒意。
但反過來,如果完全不設(shè)邊界,投入巨資訓(xùn)練前沿模型的公司也會(huì)失去安全感。
這就是 AI 知識(shí)產(chǎn)權(quán)戰(zhàn)爭(zhēng)最難的地方。
它要在保護(hù)研發(fā)投入和維持技術(shù)擴(kuò)散之間找到平衡。
這場(chǎng)戰(zhàn)爭(zhēng)不會(huì)只靠法律解決
傳統(tǒng)版權(quán)法很難直接套到大模型上。
因?yàn)槟P洼敵霰旧聿⒉豢偸枪潭ㄗ髌贰?/p>
同一個(gè)問題可能得到不同答案,同一個(gè)模型也可能隨著版本更新改變行為。
法律要證明“復(fù)制”,技術(shù)上并不容易。
所以,未來更可能出現(xiàn)的是法律、合同和技術(shù)三層防線。
合同層面,大模型平臺(tái)會(huì)在服務(wù)條款里明確禁止用輸出訓(xùn)練競(jìng)爭(zhēng)模型。
技術(shù)層面,平臺(tái)會(huì)對(duì)請(qǐng)求模式、賬號(hào)網(wǎng)絡(luò)、數(shù)據(jù)采樣方式做風(fēng)控。
法律層面,政府可能把大規(guī)模惡意蒸餾定義成不正當(dāng)競(jìng)爭(zhēng)或網(wǎng)絡(luò)濫用。
這也意味著,AI 公司之間的競(jìng)爭(zhēng)會(huì)變得更像芯片行業(yè)和藥企行業(yè)。
不僅比產(chǎn)品,還比專利、許可、訴訟和合規(guī)能力。
未來,一個(gè)模型好不好,不只看 benchmark。
還要看它的訓(xùn)練來源是否干凈,授權(quán)鏈條是否清楚,企業(yè)客戶是否敢放心使用。
![]()
普通人應(yīng)該看什么信號(hào)
這件事離普通用戶并不遠(yuǎn)。
第一個(gè)信號(hào),是主流 AI 平臺(tái)是否開始收緊免費(fèi)使用和批量調(diào)用。
如果免費(fèi)額度越來越少,企業(yè)認(rèn)證越來越嚴(yán)格,說明平臺(tái)已經(jīng)把防蒸餾當(dāng)成核心風(fēng)險(xiǎn)。
第二個(gè)信號(hào),是模型公司是否開始公開“訓(xùn)練來源說明”。
過去大家只關(guān)心模型強(qiáng)不強(qiáng),未來企業(yè)客戶會(huì)越來越關(guān)心模型是否存在侵權(quán)風(fēng)險(xiǎn)。
第三個(gè)信號(hào),是開源模型的許可證是否變得更復(fù)雜。
如果越來越多模型從寬松開源轉(zhuǎn)向限制商用或限制再訓(xùn)練,說明行業(yè)正在重新劃邊界。
第四個(gè)信號(hào),是美國(guó)和中國(guó)是否圍繞模型訪問、云服務(wù)、賬號(hào)濫用出臺(tái)更細(xì)規(guī)則。
一旦監(jiān)管介入,AI 競(jìng)爭(zhēng)就不再只是公司之間的價(jià)格戰(zhàn),而會(huì)變成國(guó)家之間的能力邊界管理。
真正的問題是,AI 的能力到底屬于誰(shuí)
Anthropic 指控阿里的這件事,無論最終如何收?qǐng)觯继嵝研袠I(yè)一個(gè)現(xiàn)實(shí)。
AI 模型的能力不是憑空出現(xiàn)的。
它來自數(shù)據(jù)、算力、算法、人類反饋、工程經(jīng)驗(yàn)和大量試錯(cuò)。
但當(dāng)這種能力以聊天回答的形式對(duì)外開放時(shí),它又會(huì)變得非常容易被復(fù)制、采樣和再訓(xùn)練。
這就是 AI 時(shí)代最棘手的矛盾。
開放越多,生態(tài)越繁榮,領(lǐng)先能力也越容易外流。
封閉越多,護(hù)城河越深,創(chuàng)新擴(kuò)散也會(huì)變慢。
未來的大模型戰(zhàn)爭(zhēng),不會(huì)只是誰(shuí)的模型更聰明。
還會(huì)是誰(shuí)能定義新的行業(yè)規(guī)則:什么是合理學(xué)習(xí),什么是惡意蒸餾,什么是技術(shù)借鑒,什么是能力盜用。
這場(chǎng)知識(shí)產(chǎn)權(quán)戰(zhàn)爭(zhēng),才剛剛開始。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.