2026 年 1 月 5 日,美國聯邦法官確認 OpenAI 必須交出 2,000 萬筆 ChatGPT 對話紀錄。根據 Bloomberg Law 報導,這些紀錄已做匿名化處理,案件是合併審理的版權訴訟——也就是圍繞 AI 訓練資料合法性、持續進行中的美國版權訴訟。
裁定內容的三個細節
- 規模:2,000 萬筆真實使用者對話進入司法程序,是少見的大規模樣本
- 匿名化:法院要求的是去除身分資訊後的版本,在隱私風險與證據價值之間取折衷
- 程序位置:法官「確認」交出義務,代表這項要求站得住,訴訟往實體審理推進
這些紀錄在訴訟中的角色
訓練資料版權訴訟的核心爭議,是 AI 業者取得與使用資料的方式是否合法。這批對話紀錄在案件中會被用來檢視什麼、證明什麼,由雙方在後續程序中界定;可以確定的是,法院願意讓千萬筆等級的真實使用資料進入證據範圍,顯示這類訴訟的證據基礎正在擴大,而不再只停留在契約與技術文件層次。
對企業與產品團隊的提醒
- 使用者與 AI 服務的對話紀錄可能因訴訟被法院要求提供,匿名化是法院認可的底線,不是免死金牌
- 打造 AI 產品時,log 的保留範圍與去識別化設計,值得預設「有天會被第三方檢視」來規劃
這場美國版權訴訟仍在進行中,後續裁定會持續改寫訓練資料的遊戲規則,值得任何拿使用者資料訓練或微調模型的團隊追蹤。
參考來源
本文由 AI 協助自上述來源整理,經人工審核後發布。
