Видавці вимагають санкцій: OpenAI закидають приховування 78 млн логів ChatGPT

A courtroom clash intensifies as media outlets claim the AI firm concealed evidence in a landmark copyright suit. (Image: Shutterstock)
A courtroom clash intensifies as media outlets claim the AI firm concealed evidence in a landmark copyright suit. (Image: Shutterstock)

Група медіакомпаній на чолі з The New York Times звернулася до федерального суду США з вимогою застосувати санкції проти OpenAI за нібито приховування масиву з 78 млн розмов та видалення мільярдів логів ChatGPT.

Ключові тези:

  • Видавці заявляють, що понад два роки OpenAI приховувала можливість шукати в логах ChatGPT і тренувальних наборах даних матеріали, захищені авторським правом.
  • У клопотанні вимагається виключити з процесу вибірку з 20 млн логів і вказується на видалення мільярдів діалогів.
  • OpenAI заперечує звинувачення і стверджує, що видавці фактично зазіхають на приватність користувачів.

Звинувачення щодо розкриття даних OpenAI

Клопотання про санкції, подане 9 липня до федерального суду Манхеттена, також подали New York Daily News, Ziff Davis та Center for Investigative Reporting. Позивачі стверджують, що OpenAI понад два роки вводила в оману суд та опонентів щодо власної здатності шукати у своїх системах новинний контент, захищений авторським правом.

Упродовж процесу компанія наполягала, що не може здійснювати пошук по тренувальному корпусу. Вона також заявляла, що надання суду логів розмов у ChatGPT є надмірно обтяжливим і становить ризик для конфіденційності користувачів.

Ця позиція почала руйнуватися у квітні, коли інженер із захисту даних Вінсент Монако під час допиту повідомив, що OpenAI вже виконувала внутрішні пошуки таких даних. За його свідченнями, компанія ще до початку судового спору зібрала приблизно 78 млн деідентифікованих розмов і проаналізувала їх на наявність новинного контенту.

Видавці кажуть, що про це їм не повідомляли, тоді як вони місяцями опрацьовували сильно зацензуровану вибірку з 20 млн логів — значно меншу за 120 млн, які вони спершу вимагали. Суд визнав цю вибірку непридатною для використання, а в клопотанні додатково стверджується, що OpenAI видалила мільярди розмов попри чинний припис про збереження доказів.

Читайте також: Чи справді Чарльз Хоскінсон полишає Cardano? Він назвав це цілковитою брехнею

Видавці домагаються жорстких санкцій

Позивачі просять суд заборонити OpenAI посилатися у процесі на вибірку з 20 млн логів. Вони також вимагають, аби суд дійшов висновку, що відповіді ChatGPT містили суттєве відтворення їхніх захищених авторським правом матеріалів, і заблокував будь-які аргументи, які це заперечують. Серед інших вимог — компенсація витрат на адвокатів і спеціальна вказівка для присяжних щодо наслідків видалення логів.

Старший юрист позивачів Іан Кросбі заявив, що OpenAI «брехала The Times, позивачам з Daily News, громадськості та суду», приховуючи проведені раніше пошуки у своїх даних. Адвокат Daily News Стівен Ліберман звинуватив компанію в тому, що вона «приховує і знищує докази того, як ChatGPT тренували на вкраденій журналістиці».

Представник OpenAI Дрю Пусатері назвав звинувачення відверто неправдивими й наголосив, що компанія й надалі «захищатиме приватність користувачів і давно усталені принципи добросовісного використання (fair use)».

The New York Times подала позов проти OpenAI та Microsoft у грудні 2023 року, заявивши, що компанії створили конкуруючі продукти на основі мільйонів її статей без згоди й винагороди. Видавець уже витратив понад 28 млн доларів на судові баталії з AI-компаніями, включно з окремим позовом проти Perplexity. Тим часом Anthropic торік погодилася виплатити авторам 1,5 млрд доларів за неліцензійне використання книжок — це найбільше на сьогодні врегулювання спору щодо авторських прав у сфері ШІ.

Читайте далі: Palantir скорочує 50 інженерів і втрачає чверть капіталізації: що пішло не так?

Alexey Bondarev profile photo

Alexey Bondarev

Олексій Бондарєв — керівник контенту в Yellow.com, який висвітлює криптовалютну тематику вже 10 років. Він спеціалізується на поглиблених матеріалах формату Research та Learn, зосереджених на аналітичній подачі, галузевому контексті та глобальних силах, що формують крипторинок — від епохи штучного інтелекту й технологій безпеки до фінтех-інновацій. Він переконаний, що все цифрове незабаром остаточно переважить усе аналогове, і наполегливо працює, щоб це стало реальністю.

Відмова від відповідальності та попередження про ризики: Інформація, надана в цій статті, призначена лише для освітніх та інформаційних цілей і базується на думці автора. Вона не є фінансовою, інвестиційною, правовою чи податковою консультацією. Криптоактиви є надзвичайно волатильними та піддаються високому ризику, включаючи ризик втрати всіх або значної частини ваших інвестицій. Торгівля або утримання криптоактивів може не підходити для всіх інвесторів. Думки, висловлені в цій статті, належать виключно автору(ам) і не представляють офіційну політику чи позицію Yellow, її засновників або керівників. Завжди проводьте власне ретельне дослідження (D.Y.O.R.) та консультуйтесь з ліцензованим фінансовим фахівцем перед прийняттям будь-яких інвестиційних рішень.
Схожі новини
Схожі дослідницькі статті
Схожі навчальні матеріали
Видавці вимагають санкцій: OpenAI закидають приховування 78 млн логів ChatGPT | Yellow