大約每個寫過書的人都可能已經成了AI訓練資料的「貢獻者」,只是本人不知道。ChatGPT、Gemini、Claude這些聊天機器人的背後,模型從數以億計的書籍、文章、論文裡學會了語言。對於作者來說,這像是一場無遮無掩的「借用」——自己的作品被拿去餵給了將要取代自己的工具。這種感覺當然很糟糕。
但糟糕歸糟糕,法律上這事遠沒有一句「這就是侵權」那麼簡單。專注於智慧財產權與網際網路法的律師Cathy Gellis對媒體直言:這個領域裡「有太多的事情同時發生」,有大量情緒化的爭論,但也有技術上的殘酷現實。
「合法但罰了15億」的裁決
去年的一起案件成了標誌性事件。法官William Alsup要求Anthropic向一批作家支付高達15億美元的版權賠償。看到這個數字,很多人下意識地認為作者贏了。然而真正讀判決會發現,法官並非認定AI訓練行為非法。
Alsup給出的結論是:Anthropic的模型訓練本身不違法——違法的是模型公司從非法的線上影子圖書館裡把書「偷」出來當訓練資料。換句話說,同樣一本書,通過正規渠道購買後用來訓練可能沒問題;從盜版網站批量下載,就是另一回事。
「像任何渴望成為作家的讀者一樣,Anthropic的大語言模型訓練並不是為了搶先複製或取代作品,而是為了轉過一個艱難的彎,去創造不同的東西。」——法官William Alsup
這個比喻很有文學味:模型讀了幾萬億詞,跟一個年輕作家埋頭讀文學經典,本質上都是「學習」。雖然作家可能不樂意,但法官至少在這一案上區分了「用內容學習」與「盜版獲取內容」兩個環節。
一張罰單,兩種解讀
律師Gellis認為,這個裁決其實對AI公司更有利。15億美元聽著嚇人,但相對於Anthropic的體量和整個行業的資源,這筆錢更像是「買路錢」。它把爭論的焦點從「能不能用版權書訓練」移到了「從哪裡拿書訓練」。後者可以通過購買正版資料集、獲取授權、甚至建設合法的內容庫來解決。
對作者來說,這個裁決並沒有關閉大門。它承認了「訓練侵權」的路徑,也給了作者們一個談判籌碼:如果AI公司不解決版權問題,就可能面臨鉅額的追償。但與此同時,它也沒有完全否定AI學習的正當性。
這件事意味著什麼
- 對作者群體:裁決提供了一個先例,證明「以訓練為目的的使用」並非天然違法,但必須有合法的資料來源。如果發現自己作品出現在盜版訓練集裡,起訴的路是通的。
- 對AI公司:繼續用盜版書訓練風險變大,但通過正規授權或購買資料可以規避最重的罰單。成本會上升,但不會動搖商業模式。
- 對法律界:這只是一系列類似訴訟的開始,後續判例可能會進一步細化「合理使用」的邊界,尤其是在美國之外。
怎麼看這件事
這不只是一場關於書的爭論,而是整個生成式AI時代的核心問題之一:機器「學習」人類作品,到底算不算侵權?目前來看,答案取決於「怎麼學」。如果你關心創作者的權益,接下來的關鍵不是等待一個「有一方全贏」的判決,而是關注資料來源合規化的程序。那些花錢購買正版訓練資料、主動建立授權機制的AI公司,可能才是這場博弈裡笑到最後的人。











評論
暫無評論
成為第一個評論的人