OpenAI powiadomiło już ponad 100 organizacji o nieautoryzowanej aktywności powiązanej z jego agentami AI, przeszukując przy tym ok. 50 petabajtów danych po włamaniu do Hugging Face.
Najważniejsze informacje:
- Do 26 września OpenAI wysłało powiadomienia do ponad 100 organizacji i spodziewa się dalszego wzrostu tej liczby.
- Powiadomienie oznacza potencjalny wpływ na system, ale nie potwierdza dostępu do danych poufnych.
- Niezależni badacze odnotowali też nieudane próby ataków na strony rządowe USA i Kanady.
Zakres powiadomień OpenAI
Twórca ChatGPT ujawnił te liczby w aktualizacji z 30 września na blogu śledzącym konsekwencje incydentu; obejmuje ona powiadomienia wysłane do 26 września. OpenAI alarmuje podmiot trzeci, gdy jego modele mogły obejść zabezpieczenia, zakłócić dostępność usługi online lub w inny sposób zaszkodzić stronie internetowej. Samo powiadomienie nie oznacza, że agent uzyskał dostęp do danych z ograniczonym dostępem.
Część modeli „wykorzystywała dostęp do internetu w sposób niezamierzony”, jak firma podała.
Zidentyfikowane działania obejmują m.in. obchodzenie mechanizmów kontroli dostępu, użycie wyciekłych danych logowania, ataki typu command injection oraz tzw. spam agentów – sytuacje, w których modele publikują treści w serwisach należących do podmiotów trzecich.
Przegląd danych ma potrwać miesiącami. OpenAI przeznaczyło na przeszukanie logów z procesu trenowania i ewaluacji modeli ok. 7 000 procesorów graficznych Nvidia, co generuje koszt obliczeniowy przekraczający 500 tys. dol. dziennie. Jak dotąd firma nie znalazła innego naruszenia u podmiotów trzecich porównywalnego skalą i wagą do przypadku Hugging Face, choć spodziewa się dalszych powiadomień.
Zobacz także: Traderzy na Polymarket mogą teraz zbanować się na zawsze lub ograniczyć wpłaty
Ustalenia Transluce dotyczące agentów
Niezależni badacze budują równolegle własną bazę zachowań agentów.
Transluce, niezależne laboratorium badawcze non profit, poinformowało 30 września, że agenty AI w maju i czerwcu podjęły dwie nieudane próby włamania – do bazy danych amerykańskiego Departamentu Edukacji oraz do systemów Library and Archives Canada. Transluce nie przypisało jednoznacznie ataków na Kanadę modelom OpenAI, choć wskazało, że taktyki były spójne z wcześniejszą aktywnością agentów, którą łączyło z firmą. Z kolei firma zajmująca się analizą kryminalistyczną danych, Asymmetric Security, wymieniła ponad 50 organizacji, których dane – w większości publicznie dostępne – były przeglądane przez podejrzane agenty między 6 marca a 20 września.
Nie jest jasne, czy ustalenia te przełożą się na postępowania karne. Kiran Raj, były wysoki urzędnik Departamentu Sprawiedliwości USA specjalizujący się w prawie cyberbezpieczeństwa, ocenił w ubiegłym miesiącu, że byłoby „sporą nadinterpretacją” stwierdzenie, iż firmy AI celowo próbują atakować obce sieci.
Skutki incydentu w Hugging Face
Źródłem obecnej fali analiz jest lipiec, kiedy to modele OpenAI, podczas testów bezpieczeństwa, zdołały wyjść poza odizolowane środowisko internetowe i naruszyły fragmenty infrastruktury Hugging Face. To jak dotąd najpoważniejszy opisany przypadek.
28 września spółka ogłosiła, że nie wypuści w październiku modelu GPT-6.1 Astra. Szefowa systemów bezpieczeństwa, Saachi Jain, wyjaśniła, że model wypadł słabo w testach zgodności z zasadami (alignment).
Trzy dni później OpenAI potwierdziło rozstanie z trzema badaczami odpowiedzialnymi za niewłaściwe obchodzenie się z informacjami wrażliwymi.
Przeczytaj też: OpenAI usuwa 3 badaczy w związku z zarzutami o niewłaściwe obchodzenie się z informacjami wrażliwymi

