舊金山聯邦法院的一紙裁定,讓AI公司Anthropic付出了一張15億美元的天價賬單。這起集體訴訟中,Anthropic被指在2021年至2022年間,從兩個大規模盜版書庫LibGen和PiLiMi下載了近50萬部作品,用來訓練自己的大模型。法院批準的和解協議,創下了版權侵權集體訴訟史上的最高賠償紀錄。
如果把這張賬單攤到每部書頭上,數字會更觸目驚心。原始清單里約48.2萬部作品,91.3%被作者或版權方認領索賠,平均每部作品拿到約3000美元的和解金。這個數字剛好是美國版權法規定的最低法定賠償額的四倍。協議同時要求Anthropic銷毀所有下載的盜版文件,作者們則保留對AI模型輸出完全復制原版內容的情形繼續追責的權利,以及針對Anthropic未來行為的索賠通道。
![]()
看似驚人的15億美元,其實只覆蓋了“用盜版來源下載書籍”這一件事,根本沒有觸及AI訓練行為本身。主審法官Alsup在此前的另一起案件中已經給出過明確信號:使用合法獲取的書籍來訓練AI,屬于“極具轉換性”的使用,完全符合合理使用原則。也就是說,今天這張罰單罰的是“順手牽羊”的下載動作,而不是用這些書喂給模型的學習過程。
這里就留下了一個微妙的灰色地帶:從全網無差別抓取網頁內容當作訓練數據,到底算不算“合法獲取”?大量AI公司的主訓練語料正是這樣沒有經過版權人明確授權就爬回來的網絡文本,而法院至今沒有對這個核心問題做出終局性判斷。因此,15億美元雖多,卻更像是一筆清理舊賬的和解金,絲毫沒能解決抓取網絡內容是否侵權的根本爭議。
所以Anthropic的這次破財消災,反而被業界視為AI實驗室在版權戰場的關鍵勝利。公司用錢買斷了特定時間窗口內的盜版下載風險,而法官此前對訓練數據合理使用的曖昧立場,幾乎等于給其他AI公司打了個樣:只要一開始用素材的方式別太難看,用網頁內容訓練模型大概率站得住腳。當然,作者們的集體訴訟遠未畫上句號,他們都盯著模型輸出里與原作“神似”的文本——那才是下一場訴訟的真正風暴眼。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.