AI 用書訓練被判合法,Anthropic 為什麼還是賠了 15 億
「合理使用。」美國法院對 Anthropic 版權官司的核心裁定,就這四個字:用書、用文章訓練 AI 模型,在著作權法下是合法的。
Anthropic 還是賠了 15 億美元。史上 AI 著作權案最高的單筆賠款。
矛盾嗎?事情拆開來不太是。
Anthropic 早期訓練 Claude,從一個叫 LibGen 的盜版書庫大量抓取資料,公司內部建了一個涵蓋七千萬冊書的中央資料庫。法院的判斷是:拿書訓練 AI 本身沒有問題,問題在你怎麼取得那些書。從盜版管道拿,就是侵權。
這個區別很關鍵,也是這場官司對整個 AI 產業最重要的判決:訓練行為本身合法,資料來源才是問題所在。
對任何一個曾經寫過文章、出過書的人,這個判決說的是:你的文字,如果 AI 公司透過合法管道取得,他們拿去訓練模型,目前法律上說是可以的。賠償範圍約涵蓋五十萬本書,每本約三千美元。目前已有超過九成涵蓋在內的作者提出索賠。但也有部分作者認為,「AI 訓練用書等於合理使用」這個原則本身就不公平。合理使用原本是為了保護評論、研究、教育性質的引用,不是讓科技公司用整個圖書館訓練商業模型。這些作者退出了和解,準備繼續告。
對 AI 產業的其他公司,Anthropic 的案子是目前唯一一份落幕的答案。OpenAI、Meta、Midjourney,跟作者和出版商的版權訴訟都還在進行。這份答案說的是:資料合法取得,你就站得住腳。資料來自盜版,就算 AI 模型本身的運作方式一模一樣,法律責任是另外一件事。
合理使用這條線劃好了,但這條線在哪裡、對誰公平、作者在這個框架裡得到的是什麼,還有很多人不服。