Водяний знак ChatGPT прямує до ЄС із застереженням: легке редагування знижує виявлення до 66%

Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)
Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)

OpenAI запроваджує невидимий водяний знак у текстах ChatGPT та Codex для користувачів у Європейському Союзі. Водночас власні тести компанії показують: проста заміна 10% слів у тексті знижує ймовірність успішного виявлення до 66%.

Основне:

  • Водяний знак з’явиться для всіх релевантних користувачів ChatGPT і Codex у ЄС на всіх тарифах протягом найближчих тижнів; для клієнтів API він залишиться опційним.
  • Заміна 25% слів синонімами у внутрішніх тестах компанії знизила точність детекції до 17%.
  • На старті доступ до детектора отримають лише відібрані дослідники та профільні організації.

Запуск водяного знака OpenAI

Компанія оголосила про запуск у понеділок у своєму блозі, зазначивши, що маркування стане доступним для користувачів ChatGPT і Codex у ЄС на всіх планах упродовж кількох тижнів. На глобальний стандарт на етапі запуску воно не перетвориться.

Розробники, які користуються API компанії в будь-якій країні, уже можуть увімкнути цю функцію для окремих моделей, хоча за замовчуванням вона лишається вимкненою. Крок є відповіддю на вимоги EU AI Act, норми якого набрали чинності 2 серпня та зобов’язують провайдерів робити машинно розпізнаваним факт генерації тексту ШІ. Компанії, що вже працюють на ринку, мають час до 2 грудня, щоб привести свої сервіси у відповідність.

Також читайте: AI-агент Binance створює стратегії з простих фраз і бере 19,99 USDC за торгівлю

Обмеження детекції textGrain

Технологія, що отримала назву textGrain, не додає жодних видимих позначок, натомість непомітно впливає на вибір слів моделлю, залишаючи статистичний «відбиток». Цей патерн зберігається навіть при копіюванні тексту і може бути виявлений спеціальним детектором.

За словами OpenAI, textGrain показав результати не гірші, а подекуди й кращі за інші підходи, включно з текстовою версією SynthID від Google. Компанія заявила, що планує зробити цю технологію відкритою.

Однак будь-яке редагування послаблює сигнал.

У тестах на фрагментах довжиною 400 токенів заміна 10% слів синонімами знизила частку коректних спрацьовувань із приблизно 92% до 66%. Коли ж замінювали 25% слів, точність падала до 17%. Короткі тексти, розв’язки математичних задач та перекладені матеріали детектуються ще гірше: наприклад, на уривках у 200 токенів на теми на кшталт психології детектор фіксував близько 80% випадків при 1% хибних спрацьовувань.

Хто отримає доступ до детектора ChatGPT

Наразі OpenAI обмежує доступ до детектора лише схваленими дослідниками та профільними організаціями, посилаючись на ризик пропуску водяних знаків і хибно позитивних результатів. Компанія окремо наголошує: відсутність водяного знака «не доводить, що текст написала людина», а саме маркування не дає змоги ідентифікувати конкретного користувача, обліковий запис чи запит, на основі якого був згенерований контент.

Цей крок іде слідом за Anthropic, яка ще в серпні заявила, що маркуватиме тексти, згенеровані Claude, по всьому світу — рішення викликало невдоволення частини користувачів. OpenAI також раніше створювала власну систему водяних знаків для тексту, проте не запускала її публічно, зокрема через побоювання, що аудиторія перейде до конкурентів, йшлося в матеріалі ЗМІ за 2024 рік.

Попри це, OpenAI та Anthropic разом із Google, Meta й Microsoft взяли на себе зобов’язання дотримуватися кодексу практики ЄС щодо прозорості ІІ-контенту.

Читайте далі: Джорджія Мелоні хоче зареєструвати свій голос як торговельну марку. Чи зупинить це AI-діпфейки?

Alexey Bondarev profile photo

Alexey Bondarev

Олексій Бондарєв — керівник відділу контенту в Yellow.com. Він спеціалізується на ґрунтовних матеріалах формату Research та Learn, зосереджених на аналітичних звітах, галузевому контексті та глобальних силах, що формують криптоіндустрію: від епохи ШІ й технологій безпеки до фінтех-інновацій. Він переконаний, що все цифрове невдовзі витіснить усе аналогове, і наполегливо працює над тим, щоб це стало реальністю.

Відмова від відповідальності та попередження про ризики: Інформація, надана в цій статті, призначена лише для освітніх та інформаційних цілей і базується на думці автора. Вона не є фінансовою, інвестиційною, правовою чи податковою консультацією. Криптоактиви є надзвичайно волатильними та піддаються високому ризику, включаючи ризик втрати всіх або значної частини ваших інвестицій. Торгівля або утримання криптоактивів може не підходити для всіх інвесторів. Думки, висловлені в цій статті, належать виключно автору(ам) і не представляють офіційну політику чи позицію Yellow, її засновників або керівників. Завжди проводьте власне ретельне дослідження (D.Y.O.R.) та консультуйтесь з ліцензованим фінансовим фахівцем перед прийняттям будь-яких інвестиційних рішень.
Останні новини
Показати всі новини
Водяний знак ChatGPT прямує до ЄС із застереженням: легке редагування знижує виявлення до 66% | Yellow