Agenci sztucznej inteligencji stworzeni przez OpenAI w lecie uzyskali dostęp do serwisów internetowych trzech amerykańskich agencji federalnych – potwierdzili przedstawiciele spółki oraz zewnętrzni badacze. W jednym z przypadków doszło do nieudanej próby włamania na stronę Departamentu Edukacji.
Najważniejsze ustalenia:
- OpenAI poinformowało, że podczas treningu jego agenci odwiedzali strony amerykańskiej Komisji Papierów Wartościowych i Giełd (SEC) oraz korzystali z danych Biura Spisu Powszechnego.
- Badacze z Transluce wskazali na nieudaną próbę włamania na stronę internetową Departamentu Edukacji.
- Ujawnienie incydentów następuje po lipcowym ataku na Hugging Face i czerwcowym włamaniu do australijskiego portalu zdrowotnego.
Agenci OpenAI na stronach rządowych
OpenAI ujawniło w piątek, że jego agenci podczas treningu pobierali publicznie dostępne informacje z dwóch serwisów Komisji Papierów Wartościowych i Giełd oraz dane z Biura Spisu Powszechnego, działającego w ramach Departamentu Handlu.
Według spółki aktywność ta miała miejsce w trakcie tzw. przebiegów treningowych. Organizacja badawcza Transluce podała, że w toku własnych analiz w otwartej sieci natrafiła na nowe ślady działań agentów i przekazała je do OpenAI.
W przypadku Biura Spisu Powszechnego jeden z agentów miał rzekomo wykorzystać dane logowania znalezione wcześniej w internecie, podczas gdy inny opublikował publiczne informacje z SEC na forum internetowym. OpenAI podkreśla, że nie odnotowano użycia danych dostępowych do systemów SEC, dostępu do informacji niejawnych ani zmian w infrastrukturze agencji. Firma zawiadomiła jednak wszystkie instytucje, których dotyczyły zdarzenia.
Sprawa Departamentu Edukacji sięgnęła dalej. Transluce poinformowało, że agenci, których źródło wyglądało na powiązane z OpenAI, podjęli prymitywną próbę włamania na stronę obsługującą biuro praw obywatelskich resortu. Atak zakończył się niepowodzeniem. Rzecznik Departamentu przekazał, że przeprowadzone przeglądy nie wykazały żadnego wpływu na działanie strony ani baz danych.
Przeczytaj także: Czy AI naprawdę może zabić 1 mld ludzi? Bill Gates twierdzi, że już ma taką moc
Transluce alarmuje o taktykach
Conrad Stosz, szef obszaru governance w Transluce, powiedział, że agenci wykorzystywali „szereg technik z szarej strefy” podczas działań na amerykańskich serwisach rządowych.
Laboratorium zgłosiło także „dodatkową, nieautoryzowaną aktywność, której nie da się jednoznacznie powiązać z OpenAI”, wymierzoną w Departament Sprawiedliwości, Departament Handlu oraz serwisy stanowe w Kalifornii, Maryland, Illinois, Teksasie i Nowym Jorku.
OpenAI przedstawia wydarzenia w łagodniejszym świetle. Według spółki większość działań miała charakter rutynowego researchu, ponieważ modele traktują strony administracji jako wiarygodne źródło informacji publicznej. Firma dodaje, że samo powiadomienie organizacji nie oznacza automatycznie incydentu bezpieczeństwa i opisuje podobne zdarzenia jako przejawy „misalignmentu”, który może wywoływać „nieoczekiwane lub budzące obawy zachowania”.
Skutki ataku na Hugging Face
Prezes OpenAI Sam Altman napisał na platformie X, że firma prowadzi „szeroko zakrojony, trwający przegląd” tego, jak jej agenci korzystali z internetu w trakcie treningu i ewaluacji. Atak na Hugging Face określił jako „najpoważniejsze zdarzenie, jakie dotąd odnotowaliśmy”.
OpenAI powiązało dwa ze swoich najbardziej zaawansowanych modeli z lipcowym cyberatakiem. Premier Australii Anthony Albanese stwierdził w środę, że agent OpenAI włamał się w czerwcu do portalu statystyk programu Medicare. Zwrócił uwagę, że spółka czekała z powiadomieniem jego rządu aż do 10 września, i podkreślił, że agent „nie przyjmował odmowy za odpowiedź”.
Zobacz również: Paxos uruchamia PAXGy z dochodem powiązanym z leasingiem złota

