2025年6月23日晚間,加州北區聯邦法院法官威廉·阿爾蘇普就Bartz訴Anthropic案做出部分簡易判決:Anthropic使用合法取得的紙本書訓練大型語言模型,屬於合理使用。這是美國法院第一次明確認可AI訓練的合理使用主張,也是這波生成式AI著作權訴訟潮中,產業拿到的第一場關鍵勝利。
但同一份判決留下尖銳的另一半:Anthropic從盜版網站下載數百萬本書建立的「中央圖書館」不受合理使用保護,相關賠償金額將由後續庭審決定。對整個產業來說,這份判決一邊打開了訓練資料的大門,一邊把「資料是怎麼來的」留在了門檻上。
判決核心:訓練屬合理使用
本案由作家Andrea Bartz、Charles Graeber與Kirk Wallace Johnson提起。阿爾蘇普裁定,Anthropic把合法購買的紙本書掃描建檔,並用這些書訓練Claude模型,都屬於合理使用——包括拆開書脊、裁切頁面、掃描成數位檔的過程。判決認為這種用途具有轉換性,而且阿爾蘇普用詞罕見地強烈:LLM訓練的轉換程度是「極其顯著的」(spectacularly so)。The Verge指出,這是AI產業第一次在這個問題上拿到法院背書,Anthropic發言人Jennifer Martinez也直接引用了這個說法。程序上,這是一次部分簡易判決:法院認為訓練用途部分沒有需要開庭的事實爭議,可以直接由法官裁斷;盜版書庫部分則因事實爭議進入庭審。對照其他仍在進行中的同類案件,這是「訓練即合理使用」第一次得到具有司法分量的答案。
敗訴部分:盜版書庫不受保護
勝利有明確邊界。判決同時認定,Anthropic從盜版網站下載、建立數百萬本書的「中央圖書館」的行為不屬於合理使用——其中部分書籍甚至從未被用於訓練。阿爾蘇普寫道,他懷疑「任何被控侵權者」能夠舉證正當化下載那些本可以合法購買的書;事後補買實體書不能消除責任,但可能降低法定賠償金額。盜版書庫的賠償數額,將由另一場庭審認定。對Anthropic來說,這部分的風險已經從「是否侵權」收斂為「賠多少」;對產業來說,法院區分了「怎麼用」與「怎麼拿」:前者可以構成合理使用,後者不行。
阿爾蘇普的關鍵論述
判決中最常被引用的兩段話,勾勒出法院對著作權目的的理解。阿爾蘇普寫道,著作權法「旨在促進原創作品的創作,而不是保護作者免於競爭」,並把訓練類比為學童透過閱讀學習寫作——沒有人會因為讀了別人的作品寫出相似風格而侵權。換句話說,法院把LLM訓練放進與人類學習同一條傳統脈絡來理解,而不是當成需要另立新規的新技術;這個「不保護免於競爭」的框架,對未來案件的影響可能比合理使用認定本身更長遠。The Verge的分析也點出一個重要限制:這份判決沒有處理AI「輸出」是否侵權的問題,而這正是其他案件中的核心爭點。
對其他AI著作權訴訟的影響
TechCrunch的評估是:這份判決對其他法院沒有拘束力,但可能成為有利於科技公司的先例,影響針對OpenAI、Meta、Midjourney、Google等公司的類似訴訟。對作者與出版方而言,判決把戰場從「訓練要不要授權」轉移到「資料怎麼取得」——後者是更具體、也更容易舉證的問題。對整個生成式AI產業而言,合法取得資料的成本結構,從這份判決開始變得可以估計。
對開發者與資料團隊的意涵
這份判決對實務工作的啟示很直接:資料的取得來源與使用方式要分開管理。訓練用途的轉換性論述獲得判例支撐,資料取得合規成了下一個戰場——取得紀錄、授權文件、資料來源鏈,未來都可能是訴訟中的關鍵證據。這也部分解釋了為什麼越來越多AI公司選擇直接與內容授權方簽約,而不是賭法院對每一批資料都給出有利認定。後續盜版書庫庭審的賠償計算方式,值得所有做資料授權與訓練語料管理的團隊追蹤:它可能成為第一個可用來估算侵權資料成本的公開參考點。
參考來源
本文由 AI 協助自上述來源整理,經人工審核後發布。
