政策監管

Sony Music 與 Warner Chappell 起訴 Anthropic,指控「史上最大規模著作權盜竊」

Sony Music Publishing 與 Warner Chappell Music 在聯邦法院起訴 Anthropic,指控其透過盜版網站大規模下載受版權保護的音樂作品與書籍來訓練 AI 模型,索賠金額可達數十億美元,並將 CEO Dario Amodei 列為個人被告。

Sony Music PublishingWarner Chappell Music 於 2026 年 8 月 29 日向美國加州北區聯邦法院提起訴訟,控告 AI 公司 Anthropic 及其共同創辦人 Dario AmodeiBenjamin Mann 涉及「有史以來最大規模且最明目張膽的知識產權盜竊行為」。這起案件可能成為 AI 產業著作權爭議的關鍵轉折點。

訴訟核心指控

個人被告:CEO 與共同創辦人被點名

不同於多數 AI 版權訴訟僅針對公司,本次起訴書將 Anthropic 的 CEO Dario Amodei 和共同創辦人 Benjamin Mann 列為個人被告。長達 48 頁的起訴書指出,Amodei「明確指示、批准、控制並故意誘導」Mann 及其他 Anthropic 員工實施侵權行為。這一法律策略大幅提升了案件的潛在責任範圍。

索賠金額與法律依據

原告方尋求以下賠償:

  • 每件被侵權作品最高 15 萬美元 的法定賠償金
  • 每項刪除版權管理資訊的違規行為最高 2.5 萬美元 的罰款

考慮到涉及的歌曲數量,總索賠金額可能達到 數十億美元

侵權行為細節

起訴書詳細列舉了 Anthropic 涉嫌的侵權行為:

  • 大規模盜版下載:Anthropic 涉嫌透過 LibGenPiLiMi 等盜版圖書館,以 BitTorrent 方式下載了至少 700 萬本 受版權保護的書籍
  • 非法爬取歌詞:公司未經授權從 MusixMatchLyricFind 等授權平台爬取歌詞,違反了這些平台的服務條款
  • 實體資料破壞:指控 Anthropic 掃描並銷毀了使用過的樂譜集和歌本
  • 爭議資料集使用:挑戰 Anthropic 使用的 Books3The PileCommon Crawl 等資料集中包含未授權內容

合成數據爭議:版權規避策略?

起訴書提出了一個關鍵的法律論點——Anthropic 可能透過合成數據來規避版權責任:

原告指控 Anthropic 至少訓練了一個商業 Claude 模型,使用的數據是由一個非商業模型生成的合成數據,而該非商業模型本身正是從 LibGen 和 PiLiMi 的文本中學習而來。他們還指控 Anthropic 使用此類模型為商業 Claude 模型提供強化學習反饋。

這一論點觸及了 AI 訓練鏈的深層次版權問題:即使最終模型未直接使用盜版資料訓練,但如果訓練過程中使用的任何中間模型接觸過侵權內容,是否仍構成侵權? 這將在案件取證階段得到進一步釐清。

Anthropic 的版權訴訟歷史

這並非 Anthropic 首次面臨大規模版權訴訟:

時間案件結果
2025 年 9 月作者與出版商集體訴訟Anthropic 同意支付 15 億美元和解金,為美國史上最大版權和解案
2025 年 11 月慕尼黑地區法院就歌詞侵權作出裁定法院認定模型參數中包含受版權保護的歌詞構成「再現」,聊天機器人輸出歌詞構成「非法公開傳播」,且模型運營商須承擔責任(而非用戶)
2026 年 8 月Sony Music 與 Warner Chappell 訴訟進行中,個人被告納入訴訟

值得注意的是,在 2025 年的和解案中,Anthropic 被認定敗訴的關鍵並非「使用版權數據訓練」,而是透過非法途徑(BitTorrent 下載)獲取這些數據。本次 Sony-Warner 訴訟針對的正是同樣的薄弱環節。

產業意義

1. AI 訓練資料的法律紅線正在劃定

這起案件與德國法院的裁決形成合力,逐步為 AI 訓練資料的法律邊界建立判例框架。對於亞洲的 AI 開發者而言,這些案件釋放出明確信號:資料獲取方式的合法性將成為 AI 版權爭議的焦點。

2. 個人責任的開創性先例

將 CEO 列為個人被告是一個重要的法律策略創新。若法院支持這一訴求,可能從根本上改變 AI 公司高層對訓練資料合規性的問責機制。

3. 合成數據非「免責金牌」

起訴書對合成數據訓練鏈的挑戰,可能關閉 AI 公司使用「模型蒸餾—合成數據生成—最終模型訓練」來間接規避版權的法律後門。


本文信息來源:THE DECODER(Matthias Bastian)報導,2026 年 8 月 30 日。另參考 Courtlistener 起訴書文本及相關法院裁定。

返回 AI 資訊