由《The New York Times》(紐約時報)領軍的多家新聞機構,周四入稟曼哈頓聯邦法院,要求對 OpenAI 作出制裁,指其隱瞞一個涵蓋約 7,800 萬次對話的 ChatGPT 數據集,並刪除以十億計的對話紀錄。
重點:
- 多家出版商指控 OpenAI 隱瞞其可在 ChatGPT 對話及訓練數據中搜尋受版權保護新聞內容的能力,時間長達兩年以上。
- 動議要求法庭禁止在審訊中使用一個 2,000 萬條對話紀錄樣本,並指 OpenAI 已在保全命令下刪除以十億計對話。
- OpenAI 全面否認指控,反批出版商企圖侵犯用戶私隱。
被指隱瞞證據與刪除對話紀錄
這份制裁動議於 7 月 9 日入稟曼哈頓聯邦法院,除《紐約時報》外,原告還包括 New York Daily News、《Ziff Davis》及 Center for Investigative Reporting。
動議指控,OpenAI 在過去兩年多一直就其能否在內部系統搜尋受版權保護新聞內容作出「誤導式陳述」。在整個訴訟過程中,OpenAI 一方面聲稱無法搜尋其訓練語料庫,另一方面又說如要提供 ChatGPT 對話紀錄,技術負擔沉重,且會損害用戶私隱。
這套說法在今年 4 月出現裂痕。隱私工程師 Vincent Monaco 在盤問下披露,OpenAI 其實早已在內部進行相關搜尋。他的證供指,公司在訴訟前已收集約 7,800 萬條「去識別化」對話,並以此篩查其中是否包含新聞內容。
出版商指,OpenAI 從未告知法庭及原告這批數據的存在;相反,他們只能花數月時間,分析一個高度遮蓋(redacted)、規模約 2,000 萬條對話的樣本——遠低於原本要求的 1.2 億條。法院其後裁定該樣本實際上難以使用,而動議進一步指控,OpenAI 在法院已發出保全命令期間,仍然刪除了以十億計的 ChatGPT 對話。
延伸閱讀:Charles Hoskinson 是否準備離開 Cardano?他斥傳聞「完全是謊言」
出版商要求施加嚴厲制裁
原告要求法院禁止 OpenAI 在審訊中依賴那份 2,000 萬條對話樣本作為證據,同時裁定 ChatGPT 的輸出內容「實質重製」了他們受版權保護的作品,並禁止 OpenAI 在庭上提出相反主張。動議亦要求賠償律師費,及向陪審團作出不利於 OpenAI 的指示,說明其已刪除關鍵紀錄。
原告首席律師 Ian Crosby 表示,OpenAI 一邊進行內部搜尋,一邊卻「向紐約時報、《Daily News》原告、公眾與法院說謊」。Daily News 的代表律師 Steven Lieberman 則指控 OpenAI「隱藏及銷毀證據,掩飾 ChatGPT 如何以『偷來的新聞作品』作訓練」。
OpenAI 發言人 Drew Pusateri 反駁,指有關說法「明顯失實」,強調公司會「繼續捍衛用戶私隱,以及行之已久的合理使用法理」。
《紐約時報》早在 2023 年 12 月,已入稟控告 OpenAI 及 Microsoft,指兩家公司未經授權或付費,利用其數以百萬計文章建立具替代性的 AI 產品。該報稱,至今為對抗多家 AI 公司訴訟已耗資超過 2,800 萬美元,當中包括另一宗針對 Perplexity 的案件。
與此同時,Anthropic 去年同意就「盜版電子書」訓練爭議,向一批作者支付 15 億美元和解金,成為迄今規模最大的 AI 版權和解之一。





