Znak wodny ChatGPT wkracza do UE z haczykiem: lekkie edycje obniżają wykrywalność do 66%

Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)
Text from OpenAI's ChatGPT and Codex will carry an invisible EU watermark that weakens when 10% of words are swapped (Image: Shutterstock)

OpenAI wprowadzi w Unii Europejskiej niewidzialny znak wodny do tekstów generowanych przez ChatGPT i Codex, choć jej własne testy pokazują, że podmiana zaledwie 10% słów obniża skuteczność wykrywania do 66%.

Najważniejsze informacje:

  • Znak wodny trafi w najbliższych tygodniach do uprawnionych użytkowników ChatGPT i Codex w UE na wszystkich planach; w API pozostanie funkcją opcjonalną.
  • Zastąpienie 25% słów synonimami obniżyło skuteczność wykrywania w wewnętrznych testach firmy do 17%.
  • Dostęp do narzędzia wykrywającego otrzymają na starcie wyłącznie zatwierdzeni badacze oraz wyspecjalizowane organizacje.

Wdrożenie znaku wodnego OpenAI

Firma ogłosiła ten krok w poniedziałek na blogu, zapowiadając, że znakowanie obejmie w ciągu najbliższych tygodni uprawnionych użytkowników ChatGPT i Codex w UE na wszystkich planach. Rozwiązanie nie stanie się globalnym standardem w momencie startu.

Deweloperzy korzystający z API firmy na całym świecie mogą już teraz włączyć znakowanie dla wybranych modeli, jednak domyślnie pozostaje ono wyłączone. Ruch ten jest odpowiedzią na unijne rozporządzenie AI Act, którego obowiązki dotyczące oznaczania treści weszły w życie 2 sierpnia i wymagają, by dostawcy umożliwiali maszynowe rozpoznawanie tekstu wygenerowanego przez AI. Firmy już obecne na rynku mają czas na dostosowanie się do 2 grudnia.

Zobacz też: Agent Binance AI buduje strategie z prostych zdań, pobiera 19.99 USDC za handel

Ograniczenia detekcji textGrain

Zastosowana metoda, nazwana textGrain, nie dodaje żadnego widocznego symbolu. Delikatnie modyfikuje natomiast dobór słów przez model, pozostawiając statystyczny wzorzec, który może wychwycić detektor – i który „podróżuje” wraz z kopiowanym tekstem. OpenAI twierdzi, że skuteczność textGrain dorównuje lub przewyższa inne testowane podejścia, w tym SynthID od Google dla tekstu, a w przyszłości technologia ma zostać udostępniona jako open source.

Edycje znacząco osłabiają ten sygnał.

W badaniu na fragmentach liczących 400 tokenów, zastąpienie 10% słów synonimami obniżyło skuteczność wykrywania z ok. 92% do 66%. Podmiana 25% słów ściągnęła ją do 17%. Trudniejsze do oznaczenia są też krótkie teksty, odpowiedzi z matematyki oraz tłumaczenia – przy długości 200 tokenów na tematy takie jak psychologia, detektor wykrywa ok. 80% przypadków przy 1% odsetku fałszywych alarmów.

Dostęp do detektora ChatGPT

Na razie OpenAI ogranicza dostęp do detektora do zatwierdzonych zespołów badawczych i wyspecjalizowanych organizacji, wskazując na ryzyko niewykrycia znaku wodnego oraz fałszywych pozytywów. Firma podkreśla też, że brak znaku wodnego „nie dowodzi, że autorem jest człowiek” oraz że samo oznaczenie nie ujawnia konkretnego użytkownika, konta ani treści promptu, z którego powstał dany fragment.

Ten krok następuje po ruchu Anthropic, która już w sierpniu zapowiedziała znakowanie tekstu generowanego przez Claude’a na całym świecie, co spotkało się z krytyką części użytkowników. OpenAI opracowała technikę znakowania tekstu już wcześniej, lecz wstrzymała jej wdrożenie – m.in. z obawy, że użytkownicy przeniosą się do konkurencji, wynika z doniesień prasowych z 2024 r. Obie firmy, a także Google, Meta i Microsoft, zadeklarowały przestrzeganie unijnego kodeksu dobrych praktyk w zakresie transparentności treści generowanych przez AI.

Przeczytaj także: Giorgia Meloni chce znaku towarowego na swój głos. Czy to powstrzyma deepfake’i AI?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analitycznych raportach, kontekście branżowym oraz większych siłach kształtujących rynek krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Uważa, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje wszystko, co analogowe, i ciężko pracuje, aby to urzeczywistnić.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.
Najnowsze wiadomości
Pokaż wszystkie wiadomości
Znak wodny ChatGPT wkracza do UE z haczykiem: lekkie edycje obniżają wykrywalność do 66% | Yellow