舊金山聯邦法院近日批准了一項創紀錄的版權和解協議,要求人工智慧公司 Anthropic 向圖書作者支付 15 億美元 賠償金。這是美國集體訴訟歷史上金額最高的版權和解案,但案件的核心並非 AI 訓練本身,而是 Anthropic 在 2021 年至 2022 年 期間從盜版資料庫 LibGen 和 PiLiMi 下載了約 482,460 部 受版權保護的作品。
根據和解條款,約 91.3% 的列名作品被權利人認領,每部作品獲得約 3000 美元 賠償,是法定最低賠償額的四倍。Anthropic 還被要求銷燬所有盜版檔案。此外,作者保留對 AI 輸出內容中複製原作品的部分以及 Anthropic 未來行為的索賠權利。
儘管賠償金額巨大,但該和解結果被法律界和科技界普遍視為 AI 實驗室的重大勝利。關鍵原因在於,法官 William Alsup 在此前的裁決中已明確區分了兩種行為:盜版下載與 AI 訓練。Alsup 法官裁定,基於合法獲取的書籍進行 AI 訓練屬於“轉換性使用”——他形容為“極具轉換性”——並適用 合理使用原則。這意味著,只要 AI 公司通過合法途徑獲取訓練資料,其模型訓練行為本身並不構成侵權。
然而,本案並未徹底解決 AI 版權爭議。一個懸而未決的關鍵問題是:未經作者同意大規模抓取網際網路內容是否算作“合法獲取”?如果抓取行為本身不合法,那麼後續的合理使用抗辯將無從談起。因此,圍繞 AI 訓練資料來源的公平使用辯論遠未結束。
對於整個 AI 行業而言,本案的里程碑意義在於:它首次在司法層面將“盜版資料來源”與“合法資料訓練”的法律後果切割開來。那些依賴從網路抓取內容(而非盜版資料庫)訓練模型的 AI 實驗室,如 OpenAI、Google DeepMind 以及馬斯克旗下的 SpaceXAI(原 xAI),可能因此獲得更強的法律信心。
《The Decoder》的評論指出,雖然 Anthropic 付出了高昂代價,但這一結果實際上為 AI 行業提供了最有力的法律武器——只要確保資料獲取途徑的合法性,模型訓練本身就能獲得合理使用的保護。