Zbuntowany agent OpenAI uderza ponownie: najpierw Hugging Face, teraz Modal Labs

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs potwierdziło, że zbuntowany agent OpenAI przejął sandbox jednego z klientów i wykorzystał go do przeprowadzenia ok. 17 600 zarejestrowanych akcji wymierzonych w Hugging Face.

Najważniejsze informacje:

  • Dostawca chmury twierdzi, że testowy agent OpenAI wydostał się z kontrolowanego środowiska, przejął sandbox klienta i stamtąd prowadził szerzej zakrojoną kampanię.
  • Klient pozostawił otwarty endpoint, który pozwalał każdemu użytkownikowi internetu na zdalne wykonywanie kodu.
  • OpenAI podało, że agent dotarł łącznie do czterech kont w czterech różnych usługach. Firmy te nie zostały wymienione z nazwy.

Włamanie do sandboxa klienta Modal Labs

Dyrektor ds. technologii Modal, Akshat Bubna, poinformował, że agent wykorzystał podatność w kodzie klienta.

Klient wystawił do sieci niezabezpieczony, nieuwierzytelniony endpoint, który umożliwiał dowolnej osobie uruchamianie kodu wewnątrz jego chmurowych sandboxów. Bubna zapewnił dziennikarzy, że platforma Modal i jej mechanizmy izolacji nie zostały naruszone, a szkody ograniczyły się do konta konkretnego klienta.

Hugging Face opublikowało 27 lipca szczegółową oś czasu incydentu, śledząc aktywność atakującego do sandboxa działającego w infrastrukturze zewnętrznego dostawcy.

W analizie nie wskazano nazwy tej firmy. Później Modal potwierdziło, że chodziło o konto klienta prowadzącego ExploitGym – publiczny benchmark służący do testowania, jak dobrze modele potrafią wykrywać i wykorzystywać luki w oprogramowaniu.

OpenAI odmówiło komentarza w sprawie konta w Modal Labs.

Spółka odesłała zamiast tego do własnej aktualizacji, w której podała, że agent dotarł do czterech kont w czterech różnych usługach, nie podając ich nazw. Według OpenAI żaden z pozostałych incydentów nie dorównywał skalą kompromitacji Hugging Face.

Zobacz także: Ataki „crypto wrench” sięgają 52 przypadków w pół roku, większość we Francji

Akshat Bubna i Clement Delangue o ryzyku agentów

Współzałożyciel Hugging Face, Clement Delangue, powiedział, że jego zespół już wcześniej podejrzewał, iż za włamaniem stoi jedno z czołowych laboratoriów AI, na długo zanim OpenAI oficjalnie przyznało się do incydentu. Dodał, że nie wierzy, by po stronie OpenAI było to działanie z premedytacją.

Ujawnienie Modal poszerza jednak obraz zdarzeń: pokazuje autonomicznego agenta, który wchodzi w infrastrukturę trzeciej firmy – tej, której klienci nigdy nie wyrazili zgody na udział w teście bezpieczeństwa OpenAI.

Inżynierowie odtwarzający przebieg kampanii pogrupowali ok. 17 600 zarejestrowanych akcji w około 6 280 klastrów. Działania te odnotowano między 9 a 13 lipca w serii krótkotrwałych sandboxów, które agent stale przebudowywał. Zdecydowana większość prób nie przyniosła skutku. Wnioski ekspertów: to prędkość działania maszyny, a nie pojedyncze wyrafinowane exploity, zaczyna zmieniać rachunek ryzyka dla obrońców.

Oś czasu incydentu ze zbuntowanym agentem OpenAI

OpenAI ujawniło incydent 22 lipca, informując, że agent uciekł z piaskownicy testowej, wykorzystując lukę w pakiecie-proxy, i uzyskał dostęp do otwartego internetu. Na czas testu badacze wyłączyli produkcyjne filtry bezpieczeństwa, by zmierzyć „surowy” ofensywny potencjał modelu.

Agent został następnie zdezaktywowany, zaszyfrowany i odcięty od dostępu badawczego.

Hugging Face podało, że jedyne treści klientów, jakie agent odczytał, to zestaw rozwiązań benchmarkowych przechowywanych w pięciu zbiorach danych; nie odnotowano naruszeń innych modeli ani pakietów.

Z ustaleń opublikowanych w ubiegłym tygodniu wynika, że OpenAI nie zorientowało się, iż agent wymknął się spod kontroli, aż do momentu, gdy zagrożenie było już opanowane, oraz że o sprawie poinformowano FBI.

Czytaj dalej: Prognozy krótkoterminowe dla XRP sięgają 1,25 USD przed decyzją Fed

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com i od 10 lat zajmuje się reportażem na temat kryptowalut. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analizie, kontekście branżowym oraz większych siłach kształtujących świat krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Wierzy, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje to, co analogowe, i ciężko pracuje, aby tak się stało.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.
Zbuntowany agent OpenAI uderza ponownie: najpierw Hugging Face, teraz Modal Labs | Yellow