Група медіакомпаній на чолі з The New York Times звернулася до федерального суду США з вимогою застосувати санкції проти OpenAI за нібито приховування масиву з 78 млн розмов та видалення мільярдів логів ChatGPT.
Ключові тези:
- Видавці заявляють, що понад два роки OpenAI приховувала можливість шукати в логах ChatGPT і тренувальних наборах даних матеріали, захищені авторським правом.
- У клопотанні вимагається виключити з процесу вибірку з 20 млн логів і вказується на видалення мільярдів діалогів.
- OpenAI заперечує звинувачення і стверджує, що видавці фактично зазіхають на приватність користувачів.
Звинувачення щодо розкриття даних OpenAI
Клопотання про санкції, подане 9 липня до федерального суду Манхеттена, також подали New York Daily News, Ziff Davis та Center for Investigative Reporting. Позивачі стверджують, що OpenAI понад два роки вводила в оману суд та опонентів щодо власної здатності шукати у своїх системах новинний контент, захищений авторським правом.
Упродовж процесу компанія наполягала, що не може здійснювати пошук по тренувальному корпусу. Вона також заявляла, що надання суду логів розмов у ChatGPT є надмірно обтяжливим і становить ризик для конфіденційності користувачів.
Ця позиція почала руйнуватися у квітні, коли інженер із захисту даних Вінсент Монако під час допиту повідомив, що OpenAI вже виконувала внутрішні пошуки таких даних. За його свідченнями, компанія ще до початку судового спору зібрала приблизно 78 млн деідентифікованих розмов і проаналізувала їх на наявність новинного контенту.
Видавці кажуть, що про це їм не повідомляли, тоді як вони місяцями опрацьовували сильно зацензуровану вибірку з 20 млн логів — значно меншу за 120 млн, які вони спершу вимагали. Суд визнав цю вибірку непридатною для використання, а в клопотанні додатково стверджується, що OpenAI видалила мільярди розмов попри чинний припис про збереження доказів.
Читайте також: Чи справді Чарльз Хоскінсон полишає Cardano? Він назвав це цілковитою брехнею
Видавці домагаються жорстких санкцій
Позивачі просять суд заборонити OpenAI посилатися у процесі на вибірку з 20 млн логів. Вони також вимагають, аби суд дійшов висновку, що відповіді ChatGPT містили суттєве відтворення їхніх захищених авторським правом матеріалів, і заблокував будь-які аргументи, які це заперечують. Серед інших вимог — компенсація витрат на адвокатів і спеціальна вказівка для присяжних щодо наслідків видалення логів.
Старший юрист позивачів Іан Кросбі заявив, що OpenAI «брехала The Times, позивачам з Daily News, громадськості та суду», приховуючи проведені раніше пошуки у своїх даних. Адвокат Daily News Стівен Ліберман звинуватив компанію в тому, що вона «приховує і знищує докази того, як ChatGPT тренували на вкраденій журналістиці».
Представник OpenAI Дрю Пусатері назвав звинувачення відверто неправдивими й наголосив, що компанія й надалі «захищатиме приватність користувачів і давно усталені принципи добросовісного використання (fair use)».
The New York Times подала позов проти OpenAI та Microsoft у грудні 2023 року, заявивши, що компанії створили конкуруючі продукти на основі мільйонів її статей без згоди й винагороди. Видавець уже витратив понад 28 млн доларів на судові баталії з AI-компаніями, включно з окремим позовом проти Perplexity. Тим часом Anthropic торік погодилася виплатити авторам 1,5 млрд доларів за неліцензійне використання книжок — це найбільше на сьогодні врегулювання спору щодо авторських прав у сфері ШІ.
Читайте далі: Palantir скорочує 50 інженерів і втрачає чверть капіталізації: що пішло не так?






