由 《紐約時報》(The New York Times) 領銜的多家新聞機構,周四向聯邦法官聲請制裁 OpenAI,指控該公司隱匿一批約 7,800 萬筆的對話資料集,並在訴訟期間刪除數十億筆 ChatGPT 日誌。
重要重點:
- 出版方指控 OpenAI 長達兩年多刻意隱瞞,事實上具備在 ChatGPT 日誌及訓練資料中搜尋受版權保護新聞內容的能力。
- 制裁聲請要求法院禁止 OpenAI 在審判中使用一組 2,000 萬筆日誌樣本,並指控其已刪除數十億筆對話紀錄。
- OpenAI 全盤否認,反批媒體要求實際上是企圖侵犯使用者隱私。
指控 OpenAI 取證過程不實
這份制裁動議於 7 月 9 日向曼哈頓聯邦法院提出,除《紐約時報》外,原告還包括 《New York Daily News》、Ziff Davis 與 調查報導中心(Center for Investigative Reporting)。
動議指稱,OpenAI 在過去兩年多期間,一再向法院與對造錯誤陳述其系統能力,宣稱無法在自家訓練語料中搜尋受版權保護的新聞內容。
在訴訟過程中,OpenAI 堅稱其訓練語料庫無法被有效檢索;同時表示,若要提供 ChatGPT 對話紀錄作為證據,不僅負擔沉重,也會嚴重危及使用者隨機對話的隱私。
然而,這套說法在今年 4 月出現裂痕。資安與隱私工程師 Vincent Monaco 在盤問過程中證實,OpenAI 內部早已能執行此類搜尋。他的證詞顯示,公司在訴訟爆發前,就蒐集了約 7,800 萬筆去識別化的 ChatGPT 對話,並用來篩查其中是否包含新聞內容。
出版方指控,在他們花了數月時間,分析法院核准、但大量被塗黑處理的 2,000 萬筆日誌樣本期間,OpenAI 從未揭露這批 7,800 萬筆對話資料的存在,實際提供的量遠低於原告最初要求的 1.2 億筆。法院最後認定該 2,000 萬筆樣本「不可用」。
動議進一步指稱,在法院早已下達「保存證據」命令的情況下,OpenAI 仍刪除了數十億筆 ChatGPT 對話紀錄,涉嫌違反取證義務及妨害司法。
延伸閱讀:Charles Hoskinson 要離開 Cardano?他斥為「完全是謊言」
出版方要求重罰與不利推定
原告陣營請求法院禁止 OpenAI 在未來審判中,利用那組 2,000 萬筆日誌樣本作為辯護或抗辯依據;同時,要求法官直接認定:ChatGPT 的輸出內容,確實「實質性重製」了他們享有版權的新聞作品,並禁止 OpenAI 在庭上提出任何相反主張。
此外,動議也請求法院裁定 OpenAI 支付原告的律師費,並在未來陪審團審理時給出特別說明,要求陪審團就「被刪除日誌」作出對 OpenAI 不利的推定。
原告首席律師 Ian Crosby 指出,OpenAI 「對《紐約時報》、對 Daily News 原告、對大眾以及對法院說了謊」,刻意掩蓋其已在內部進行的搜尋作業。Daily News 的律師 Steven Lieberman 則直指 OpenAI「隱匿並銷毀證據,以掩蓋 ChatGPT 如何以被竊取的新聞報導進行訓練」。
代表 OpenAI 發言的 Drew Pusateri 回應,相關主張「顯然不實」,強調公司將「持續捍衛使用者隱私以及早已確立的合理使用(fair use)法律原則」。
《紐約時報》在 2023 年 12 月控告 OpenAI 與 微軟(Microsoft),主張兩家公司在未經授權、未支付任何對價的情況下,以數以百萬計的《紐時》文章訓練模型,打造可取代新聞原文的產品。
根據公開資料,《紐時》至今為對抗多家 AI 業者,訴訟支出已逾 2,800 萬美元,其中包括另一起對 Perplexity 提出的訴訟。另一方面,Anthropic 去年同意就「以盜版書籍訓練模型」爭議向作者支付 15 億美元和解金,目前仍是金額最高的 AI 版權和解案例。





