[Tempest AI 深度解讀] Anthropic 15 億美元和解案的雙重判決:盜版資料違法,買書拆解可合法 (2026-08-03)

這不是一場單純的「AI 公司因拿書訓練而賠錢」事件。真正重要的分界是:美國法院把取得書籍、建立資料庫、訓練模型與產生輸出視為不同利用行為,逐一判斷。結果形成看似矛盾、實則相當精細的界線——訓練模型可能屬合理使用,買下紙本後一換一掃描也可能合法,但從盜版網站取得並永久保存數百萬本書,不能只靠「最後拿來訓練 AI」一語免責。

事件背景:15 億美元買下的是訴訟風險

2026 年 7 月20日,加州北區聯邦地方法院正式核准 Anthropic 與作者、出版權利人的15億美元集體訴訟和解。法院文件顯示,和解作品清單共有482,460件;截至2026年4月16日,其中440,490件、即91.3%已有人提出權利主張。每件作品估計可分得約3,000美元,但仍須扣除費用與成本。法院另核給原告律師約1.016億美元報酬。正式核准命令見:https://law.justia.com/cases/federal/district-courts/california/candce/4%3A2024cv05417/434709/680/

原始報導將焦點放在「盜版要和解、拆書掃描卻可能合法」的反差:https://www.digitaltrends.com/computing/anthropic-is-paying-1-5-billion-over-pirated-books-but-it-can-still-legally-cut-up-purchased-ones/。不過需要釐清:15億美元是雙方和解金,不是法院經完整審判後裁定的罰款,也不代表清單內每一件作品都已獲得終局侵權認定。法院在先前程序中認為原告對下載行為有力,但仍須面對事實證明、故意侵權及上訴等風險;和解讓這些問題不再進入原訂審判。

法院拆成三個行為,而不是只問「有沒有訓練 AI」

  1. 建立盜版中央圖書館:法院紀錄指出,Anthropic 從 Books3、LibGen及PiLiMi取得逾700萬本書,並打算長期保留為一般用途資料庫。法院不接受「日後可能用於訓練」足以正當化最初下載及永久保存的主張。
  2. 紙本的一換一數位轉換:Anthropic 花費數百萬美元購買數百萬本紙本書,拆除裝訂、掃描後丟棄原件。法院認為,在數位檔不對外散布、沒有同時保留紙本而增加市場副本的前提下,這是為節省空間與提高搜尋性的格式替換,可以構成合理使用。
  3. 用特定副本訓練模型:法院將模型訓練視為高度轉化性的用途,並注意到原告當時挑戰的是輸入端,沒有主張 Claude 已向使用者輸出侵權內容,因此裁定本案所涉訓練副本屬合理使用。

2025年的合理使用裁定全文清楚呈現上述區分:https://app.midpage.ai/document/bartz-v-anthropic-pbc-1000443577770。關鍵並非「付錢買過同一本書,就能洗白先前的盜版檔案」;裁定反而明言,事後購買不會消除先前取得盜版副本的責任。

商業邏輯:資料來源正式成為模型成本

來源事實是:法院接受合法購書後的封閉式格式轉換,也接受本案特定事實下的模型訓練,卻拒絕替永久盜版資料庫提供通行證。合理推論是:大型模型公司的競爭成本將不再只有算力、人才與資料量,還包括每一批資料的來源證明、權利鏈、用途紀錄與刪除政策。企業若無法說明檔案何時取得、是否授權、曾進入哪些模型及是否仍被保留,就可能無法把「合法用途」與「侵權取得」切割開來。

作者觀點是:這項和解並未替所有書籍建立統一的AI訓練授權價格,卻把資料來源不明的尾端風險具體化為十億美元級成本。對模型業者而言,直接授權、購買實體書或使用公共領域資料,原本可能被視為繁瑣流程;如今「省下取得成本、留下無法稽核的資料庫」反而可能是更昂貴的選項。

容易忽略的限制:這不是全美AI著作權終局答案

第一,合理使用判斷來自單一聯邦地方法院,和解又使爭點未經上訴法院完整檢驗,不能理解為所有美國法院都必須接受「AI訓練必然合法」。第二,裁定反覆區分輸入、資料庫與輸出;如果模型能重現原文,或生成內容實際取代特定作品市場,可能形成另一種訴因。第三,和解的豁免範圍主要涵蓋過去的AI輸入行為,不包含輸出爭議,也不涵蓋2025年8月25日以後的未來行為。獨立查證報導亦指出,部分退出和解的作者與出版商另行提告,案件並未因此在產業層次全部結束:https://m.investing.com/news/stock-market-news/us-judge-approves-anthropics-15-billion-settlement-of-copyright-lawsuit-4801706?ampMode=1

對台灣的意義:合法買到,不等於自動取得數位重製權

台灣出版業、本土語料庫與模型開發者不能直接套用美國判決。台灣《著作權法》第65條同樣要求綜合考量利用目的與性質、著作性質、利用比例及對潛在市場與現有價值的影響,但是否合理使用仍須依個案判斷:https://www.tipo.gov.tw/tw/copyright/694-17672.html。因此,在台灣買下一本紙本書,並不能單憑所有權推導出大規模拆書、掃描與訓練必然合法。

真正可借鏡的是合規方法,而非裁判結論。本土模型、研究機構與資料庫業者應至少保存採購或授權證明、作品與版本清單、資料處理歷程、訓練批次及刪除紀錄;出版商則可把授權範圍拆成「資料庫保存、模型訓練、檢索增強、輸出重現及後續模型更新」,避免只用一句籠統的「AI使用權」處理不同風險。智慧財產局也已將生成式AI訓練的合理使用列為持續形成中的國際法制議題:https://www.tipo.gov.tw/tw/tipo1/799-76359.html

後續應觀察什麼

  • 和解金實際分配、權利衝突及每件作品扣除成本後的淨額。
  • 退出和解者的個別訴訟,是否產生不同的合理使用或損害賠償標準。
  • 其他法院是否同意把「取得來源」、「中央資料庫」、「訓練副本」與「模型輸出」分開審查。
  • 模型公司是否公開資料來源稽核、刪除與授權政策,以及出版業能否建立可規模化的集體授權機制。

這起案件最深遠的訊息不是「買書就能任意餵給AI」,也不是「訓練一律侵權」,而是技術目的無法回頭替不合法的取得方式背書。當資料成為模型的核心資產,來源可證明、用途可分割、流向可追蹤,將與模型效能一樣成為真正的競爭門檻。

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *