OpenAI внедряет невидимый водяной знак в тексты ChatGPT и Codex для пользователей в Европейском союзе. Однако собственные тесты компании показывают: достаточно заменить около 10% слов, чтобы точность обнаружения снизилась до 66%.
Основное:
- Водяной знак в ближайшие недели станет доступен всем подходящим пользователям ChatGPT и Codex в ЕС на любых тарифах; для клиентов API он останется опцией по выбору.
- Замена 25% слов синонимами в тестах OpenAI снижала вероятность обнаружения до 17%.
- Доступ к детектору на старте получат только отобранные исследователи и профильные организации.
Запуск водяного знака OpenAI
Компания объявила о запуске в понедельник в корпоративном блоге, уточнив, что маркировка в ближайшие недели дойдёт до всех подходящих пользователей ChatGPT и Codex в ЕС, независимо от тарифа. Глобальным стандартом по умолчанию эта функция на старте не станет.
Разработчики, использующие API OpenAI в любой точке мира, уже сейчас могут включить водяной знак для отдельных моделей, но по умолчанию он будет отключён. Этот шаг — ответ на требования регламента EU AI Act: его положения о маркировке вступили в силу 2 августа и обязывают провайдеров делать машинно распознаваемой генерацию ИИ‑контента. У компаний, уже работающих на рынке, есть время до 2 декабря, чтобы привести свои системы в соответствие.
Также по теме: ИИ‑агент Binance строит стратегии “из слов”, берёт 19,99 USDC за каждую сделку
Ограничения детектора textGrain
Используемый метод под названием textGrain не добавляет в текст никаких видимых символов. Вместо этого он незаметно меняет вероятности выбора слов моделью, создавая статистический рисунок, который затем может уловить специальный детектор. Этот “отпечаток” сохраняется и при копировании текста. По данным OpenAI, textGrain не уступает, а по ряду метрик превосходит другие протестированные подходы, включая SynthID для текста от Google. Технологию планируют сделать открытой.
Любое редактирование ослабляет сигнал.
В испытаниях на отрывках длиной 400 токенов замена 10% слов синонимами снижала вероятность успешного обнаружения примерно с 92% до 66%. Замена 25% слов урезала этот показатель до 17%. Короткие фрагменты текста, решения по математике и переводы также значительно труднее маркируются: для текстов на 200 токенов по таким темам, как психология, детектор фиксировал около 80% случаев при уровне ложных срабатываний около 1%.
Доступ к детектору ChatGPT
На первом этапе OpenAI ограничит использование детектора кругом одобренных исследователей и экспертных организаций, объясняя это рисками пропуска водяных знаков и ложноположительных ответов. Компания отдельно подчёркивает: отсутствие водяного знака “не доказывает, что текст написан человеком”, а сама метка не раскрывает личность пользователя, его аккаунт или исходный запрос.
Этот шаг следует за Anthropic, которая ещё в августе заявила о глобальном внедрении водяных знаков в текст Claude — решение вызвало недовольство части пользователей. OpenAI, по сообщениям прессы за 2024 год, уже разрабатывала механизм текстовой маркировки, но отложила запуск, в том числе из опасений, что аудитория уйдёт к конкурентам. Обе компании, а также Google, Meta и Microsoft взяли на себя обязательства по выполнению европейского кодекса практики по прозрачности ИИ‑контента.
Читайте далее: Джорджа Мелони хочет запатентовать свой голос. Остановит ли это ИИ‑дипфейки?

