美國司法部(DOJ)在涉及《紐約時報》的合併訴訟中支援AI公司,主張使用受版權保護的材料訓練AI模型屬於合理使用。該案由《紐約時報》於2023年底在曼哈頓聯邦法院提起,指控OpenAI和微軟未經許可使用數百萬篇NYT文章訓練GPT-4等模型,並構建與之競爭的資訊產品。《紐約時報》索賠數十億美元,並要求銷燬基於其文章訓練的語言模型。此案被視為AI版權問題的風向標,司法部的立場可能對法院判決產生重要影響。

司法部認為,訓練與輸出之間存在法律區別:訓練過程中複製完整作品但未公開,且模型輸出“通常(若非總是)缺乏實質性相似”。司法部駁斥了將兩者混為一談的“市場損害”理論,認為這“在法律上是錯誤的”。司法部還以作家瓊·狄迪恩為例,稱她年輕時抄寫海明威故事以學習寫作,若按原告邏輯,她每次出版都可能面臨責任。

司法部強調,大語言模型具有創造性和社會價值,人類使用LLM創作原創作品,若僅因訓練就施加責任,將扼殺版權法本應保護的創造力。據報道,連《紐約時報》的記者也使用LLM起草和編輯文章。

然而,批評者指出,這些論點忽略了規模問題:單個作者抄寫文本學習是一回事,而一家數十億美元的公司將內容轉化為競爭性大眾產品則是另一回事。美國版權局在報告中明確拒絕了對AI訓練適用全面合理使用,認為AI處理完美副本並以遠超人類的速度和規模生成內容,商業應用若與現有市場中的原創作品競爭,則超出合理使用範圍。

司法部在檔案中直接反駁了版權局報告,稱前版權局局長希拉·珀爾穆特的評估不具法律約束力,且報告忽視了逐案分析的法律先例和法定的市場損害型別。珀爾穆特在報告發布後不久被特朗普政府解職。民主黨眾議員喬·莫雷爾表示,她因拒絕為AI訓練版權作品合法化背書而被解僱,這一立場得到特朗普盟友埃隆·馬斯克的支援。司法部在腳註中指出,珀爾穆特正在對解僱提出異議。

此案凸顯了AI版權問題的複雜性,以及政府內部不同機構之間的分歧。司法部支援AI公司的立場,可能為AI行業提供法律上的喘息空間,但最終裁決仍取決於法院。無論結果如何,此案都將為未來AI訓練與版權法的互動設定先例。