OpenAI запроваджує невидимий водяний знак у текстах ChatGPT та Codex для користувачів у Європейському Союзі. Водночас власні тести компанії показують: проста заміна 10% слів у тексті знижує ймовірність успішного виявлення до 66%.
Основне:
- Водяний знак з’явиться для всіх релевантних користувачів ChatGPT і Codex у ЄС на всіх тарифах протягом найближчих тижнів; для клієнтів API він залишиться опційним.
- Заміна 25% слів синонімами у внутрішніх тестах компанії знизила точність детекції до 17%.
- На старті доступ до детектора отримають лише відібрані дослідники та профільні організації.
Запуск водяного знака OpenAI
Компанія оголосила про запуск у понеділок у своєму блозі, зазначивши, що маркування стане доступним для користувачів ChatGPT і Codex у ЄС на всіх планах упродовж кількох тижнів. На глобальний стандарт на етапі запуску воно не перетвориться.
Розробники, які користуються API компанії в будь-якій країні, уже можуть увімкнути цю функцію для окремих моделей, хоча за замовчуванням вона лишається вимкненою. Крок є відповіддю на вимоги EU AI Act, норми якого набрали чинності 2 серпня та зобов’язують провайдерів робити машинно розпізнаваним факт генерації тексту ШІ. Компанії, що вже працюють на ринку, мають час до 2 грудня, щоб привести свої сервіси у відповідність.
Також читайте: AI-агент Binance створює стратегії з простих фраз і бере 19,99 USDC за торгівлю
Обмеження детекції textGrain
Технологія, що отримала назву textGrain, не додає жодних видимих позначок, натомість непомітно впливає на вибір слів моделлю, залишаючи статистичний «відбиток». Цей патерн зберігається навіть при копіюванні тексту і може бути виявлений спеціальним детектором.
За словами OpenAI, textGrain показав результати не гірші, а подекуди й кращі за інші підходи, включно з текстовою версією SynthID від Google. Компанія заявила, що планує зробити цю технологію відкритою.
Однак будь-яке редагування послаблює сигнал.
У тестах на фрагментах довжиною 400 токенів заміна 10% слів синонімами знизила частку коректних спрацьовувань із приблизно 92% до 66%. Коли ж замінювали 25% слів, точність падала до 17%. Короткі тексти, розв’язки математичних задач та перекладені матеріали детектуються ще гірше: наприклад, на уривках у 200 токенів на теми на кшталт психології детектор фіксував близько 80% випадків при 1% хибних спрацьовувань.
Хто отримає доступ до детектора ChatGPT
Наразі OpenAI обмежує доступ до детектора лише схваленими дослідниками та профільними організаціями, посилаючись на ризик пропуску водяних знаків і хибно позитивних результатів. Компанія окремо наголошує: відсутність водяного знака «не доводить, що текст написала людина», а саме маркування не дає змоги ідентифікувати конкретного користувача, обліковий запис чи запит, на основі якого був згенерований контент.
Цей крок іде слідом за Anthropic, яка ще в серпні заявила, що маркуватиме тексти, згенеровані Claude, по всьому світу — рішення викликало невдоволення частини користувачів. OpenAI також раніше створювала власну систему водяних знаків для тексту, проте не запускала її публічно, зокрема через побоювання, що аудиторія перейде до конкурентів, йшлося в матеріалі ЗМІ за 2024 рік.
Попри це, OpenAI та Anthropic разом із Google, Meta й Microsoft взяли на себе зобов’язання дотримуватися кодексу практики ЄС щодо прозорості ІІ-контенту.
Читайте далі: Джорджія Мелоні хоче зареєструвати свій голос як торговельну марку. Чи зупинить це AI-діпфейки?

