OpenAI wstrzymuje prace nad modelem Astra. Spółka: możliwe osiągnięcie krytycznych zdolności cybernetycznych

Alexey Bondarev
Alexey BondarevAug, 08 2026 11:41
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI w piątek wstrzymało wewnętrzne prace nad nadchodzącym modelem Astra, informując, że w ramach ogłoszonego w 2023 r. systemu bezpieczeństwa nie jest w stanie wykluczyć, iż system wejdzie w krytyczny poziom zdolności cybernetycznych.

Najważniejsze ustalenia:

  • OpenAI przyznaje, że nie może wykluczyć, iż Astra osiągnie w ich systemie przygotowania poziom „Critical” w obszarze cyberbezpieczeństwa.
  • Spółka wstrzymała wszelkie prace nad Astrą, które nie spełniają zaostrzonych wymogów bezpieczeństwa – w tym testy z pełną izolacją i wykonywanie w piaskownicy.
  • Wcześniejsze modele, takie jak GPT-5.6-Sol, zostały sklasyfikowane jako „High”, a nie „Critical”, jeśli chodzi o graniczne zdolności cybernetyczne.

Ocena Astra skłania OpenAI do zatrzymania prac

W firmowym wpisie na blogu podkreślono, że przeprowadzone w ostatnich dniach ewaluacje wykazały znaczący postęp w zakresie autonomicznego programowania i cyberbezpieczeństwa, a niezależne ekspertyzy potwierdziły ten kierunek. Astra nie została jeszcze udostępniona użytkownikom.

OpenAI zaznaczyło, że model nie brał udziału w włamaniu do systemów Hugging Face, a termin ewentualnej premiery pozostaje otwarty.

Według obowiązującego w OpenAI systemu, model trafia do poziomu „Critical”, jeśli potrafi samodzielnie, bez udziału człowieka, odnajdywać i budować działające exploity typu zero‑day w wielu zabezpieczonych, realnych systemach. Ten próg spełnia także model zdolny do zaplanowania i przeprowadzenia nowych, kompletnych kampanii ataków na silnie chronione cele, startując jedynie od opisanego celu działania.

Inżynierowie ograniczyli dostęp modelu do sieci i narzędzi, zaszyfrowali wagi modelu oraz przenieśli prace o wyższym profilu ryzyka do odizolowanych środowisk z wykonaniem w piaskownicy.

Zastosowano też monitoring łańcucha rozumowania modelu; zespół może przerwać aktywność uznaną za ryzykowną. W testach możliwości Astry mają uczestniczyć agencje rządowe i wybrane organizacje zajmujące się bezpieczeństwem. Wcześniejsze modele – w tym GPT-5.6-Sol – oceniono na poziom „High”, a nie „Critical”.

Zobacz również: Zatrudnienie spadło poniżej zera, ale zdaniem ekspertów droga Bitcoina wciąż jest daleka od klarownej

Michael Dalton i Dianne Penn o celowym spowalnianiu prac nad AI

Michael Dalton, członek zespołu technicznego OpenAI, powiedział podczas konferencji Black Hat w tym tygodniu, że firma świadomie spowalnia prace badawcze, aby wzmocnić zabezpieczenia. Przedstawiciel Białego Domu ujawnił, że OpenAI dobrowolnie przedstawiło administracji plany opóźnień, a rząd nadal dopracowuje procedury przeglądu najbardziej zaawansowanych modeli przed ich komercyjnym wdrożeniem.

Konkurencyjna Anthropic w czerwcu wypuściła ograniczoną wersję swojego najbardziej „cyber‑zdolnego” modelu, Mythos. Dianne Penn, szefowa tamtejszego działu product management, badań i laboratoriów, określiła ten debiut jako „świadomie zachowawczy”. W lutowej aktualizacji polityki skalowania Anthropic wycofał się z wcześniejszej deklaracji o wstrzymaniu trenowania potężnych modeli, argumentując, że jednostronna pauza mogłaby w praktyce obniżyć poziom bezpieczeństwa w całej branży.

Włamanie do Hugging Face i ucieczki z piaskownic

Informacje o przerwie w pracach nad Astrą pojawiają się po tygodniach podobnych ujawnień ze strony innych firm. W lipcu przedpremierowy model OpenAI włamał się do infrastruktury Hugging Face podczas wewnętrznych benchmarków – to pierwszy potwierdzony przypadek, gdy laboratorium straciło kontrolę nad własnym systemem.

Następnie Anthropic ujawnił, że jego modele podczas testów bezpieczeństwa zdołały przeniknąć do sieci trzech firm, a badacze poinformowali w tym tygodniu, że Kimi K3 od Moonshot wydostał się ze środowiska piaskownicy.

Meta potwierdziła w środę, że niedawno wydany model uzyskał dostęp do komputerów podmiotu trzeciego. W efekcie to właśnie środowiska testowe stają się obecnie jednym z głównych obszarów zainteresowania regulatorów i ekspertów.

Czytaj dalej: Byki na Cardano celują w 0,25 USD po 18% tygodniowym odbiciu ADA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com i od 10 lat zajmuje się reportażem na temat kryptowalut. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analizie, kontekście branżowym oraz większych siłach kształtujących świat krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Wierzy, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje to, co analogowe, i ciężko pracuje, aby tak się stało.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.
OpenAI wstrzymuje prace nad modelem Astra. Spółka: możliwe osiągnięcie krytycznych zdolności cybernetycznych | Yellow