OpenAI wprowadzi w Unii Europejskiej niewidzialny znak wodny do tekstów generowanych przez ChatGPT i Codex, choć jej własne testy pokazują, że podmiana zaledwie 10% słów obniża skuteczność wykrywania do 66%.
Najważniejsze informacje:
- Znak wodny trafi w najbliższych tygodniach do uprawnionych użytkowników ChatGPT i Codex w UE na wszystkich planach; w API pozostanie funkcją opcjonalną.
- Zastąpienie 25% słów synonimami obniżyło skuteczność wykrywania w wewnętrznych testach firmy do 17%.
- Dostęp do narzędzia wykrywającego otrzymają na starcie wyłącznie zatwierdzeni badacze oraz wyspecjalizowane organizacje.
Wdrożenie znaku wodnego OpenAI
Firma ogłosiła ten krok w poniedziałek na blogu, zapowiadając, że znakowanie obejmie w ciągu najbliższych tygodni uprawnionych użytkowników ChatGPT i Codex w UE na wszystkich planach. Rozwiązanie nie stanie się globalnym standardem w momencie startu.
Deweloperzy korzystający z API firmy na całym świecie mogą już teraz włączyć znakowanie dla wybranych modeli, jednak domyślnie pozostaje ono wyłączone. Ruch ten jest odpowiedzią na unijne rozporządzenie AI Act, którego obowiązki dotyczące oznaczania treści weszły w życie 2 sierpnia i wymagają, by dostawcy umożliwiali maszynowe rozpoznawanie tekstu wygenerowanego przez AI. Firmy już obecne na rynku mają czas na dostosowanie się do 2 grudnia.
Zobacz też: Agent Binance AI buduje strategie z prostych zdań, pobiera 19.99 USDC za handel
Ograniczenia detekcji textGrain
Zastosowana metoda, nazwana textGrain, nie dodaje żadnego widocznego symbolu. Delikatnie modyfikuje natomiast dobór słów przez model, pozostawiając statystyczny wzorzec, który może wychwycić detektor – i który „podróżuje” wraz z kopiowanym tekstem. OpenAI twierdzi, że skuteczność textGrain dorównuje lub przewyższa inne testowane podejścia, w tym SynthID od Google dla tekstu, a w przyszłości technologia ma zostać udostępniona jako open source.
Edycje znacząco osłabiają ten sygnał.
W badaniu na fragmentach liczących 400 tokenów, zastąpienie 10% słów synonimami obniżyło skuteczność wykrywania z ok. 92% do 66%. Podmiana 25% słów ściągnęła ją do 17%. Trudniejsze do oznaczenia są też krótkie teksty, odpowiedzi z matematyki oraz tłumaczenia – przy długości 200 tokenów na tematy takie jak psychologia, detektor wykrywa ok. 80% przypadków przy 1% odsetku fałszywych alarmów.
Dostęp do detektora ChatGPT
Na razie OpenAI ogranicza dostęp do detektora do zatwierdzonych zespołów badawczych i wyspecjalizowanych organizacji, wskazując na ryzyko niewykrycia znaku wodnego oraz fałszywych pozytywów. Firma podkreśla też, że brak znaku wodnego „nie dowodzi, że autorem jest człowiek” oraz że samo oznaczenie nie ujawnia konkretnego użytkownika, konta ani treści promptu, z którego powstał dany fragment.
Ten krok następuje po ruchu Anthropic, która już w sierpniu zapowiedziała znakowanie tekstu generowanego przez Claude’a na całym świecie, co spotkało się z krytyką części użytkowników. OpenAI opracowała technikę znakowania tekstu już wcześniej, lecz wstrzymała jej wdrożenie – m.in. z obawy, że użytkownicy przeniosą się do konkurencji, wynika z doniesień prasowych z 2024 r. Obie firmy, a także Google, Meta i Microsoft, zadeklarowały przestrzeganie unijnego kodeksu dobrych praktyk w zakresie transparentności treści generowanych przez AI.
Przeczytaj także: Giorgia Meloni chce znaku towarowego na swój głos. Czy to powstrzyma deepfake’i AI?

