OpenAI wskazuje trzy błędy stojące za nagłym spadkiem formy GPT-6 Astra

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAI usunęło trzy kluczowe usterki, które stały za tygodniem skarg użytkowników, iż nowy model GPT-6 Astra „zgłupiał” po premierze. Firma jednocześnie resetuje limity wykorzystania dla subskrybentów pakietu Codex.

Najważniejsze informacje:

  • Użytkownicy Astra przez cały tydzień publikowali testy porównawcze, sugerując, że model został po cichu osłabiony po starcie.
  • Szef Codex w OpenAI wskazał trzy główne przyczyny, w tym eksperyment z kontekstem, który objął ok. 4–5 tys. użytkowników.
  • Poprzedni flagowy model firmy, GPT-5.6 Sol, był w lipcu oskarżany o dokładnie to samo.

OpenAI łata błędy jakościowe w Astra

Szef produktu Codex, Tibo Sottiaux, poinformował, że zespół wspólnie z użytkownikami zidentyfikował źródła problemów, wdrożył poprawki oraz pełny reset wykorzystania jeszcze przed północą czasu lokalnego. Szczegóły podał w aktualizacji opublikowanej w sobotę. Umiejętności przygotowane pierwotnie dla starszych modeli uruchamiały się zbyt często, w praktyce uniemożliwiając Astra weryfikację własnych odpowiedzi.

Dodatkowo dobrowolny eksperyment z zarządzaniem kontekstem mógł powodować przedwczesne ucinanie odpowiedzi lub reaktywowanie się na przestarzałe wiadomości. OpenAI wyłączyło ten eksperyment po tym, jak dotknął on szacunkowo 4–5 tys. użytkowników testu. Część silników była też źle skonfigurowana, co mierzalnie pogarszało jakość na „ogonowym” ruchu kierowanym przez te instancje. Firma usunęła te silniki i przeprowadziła szereg mniejszych napraw. Jak napisał Sottiaux we wpisie w serwisie X, model lepiej śledzi teraz najnowszą wiadomość użytkownika.

Zobacz także: Ethereum mierzy się z barierą podaży przy 2 800 USD po skoku napływów do ETF do 216 mln USD

Użytkownicy Astra zgłaszają regres w jakości kodu

W ciągu tygodnia narastała fala skarg w serwisie X. Programiści uruchamiali identyczne prompty na wersji Astra z dnia premiery oraz na aktualnej odsłonie modelu, zachowując takie same ustawienia, a następnie porównywali wyniki. Deweloper Pranjal Paliwal, który jeszcze kilka dni wcześniej chwalił model, wrócił do wygenerowanego przez Astra kodu i ocenił, że zamiast postępu widać tu regres.

Dax Raad, twórca narzędzia programistycznego Opencode, po testach zdecydował się przywrócić w swoim zespole starszy model GPT-5.6 Sol. Koszt korzystania z Astra praktycznie się podwoił, a – jego zdaniem – dodatkowe wydatki nie przekładały się na adekwatne korzyści.

Jeden z użytkowników forum opisał, że Astra w obecnej formie jest zaledwie „na równi” z modelem Sol przy tych samych zadaniach i liczbie ponowień. Nie wszyscy podzielali tę opinię: anonimowy użytkownik piszący jako Antikythera argumentował, że model od początku był „leniwy” i miał skłonność do list punktowanych, a użytkownicy po prostu przestali się zachwycać.

Limity mocy obliczeniowej cieniem na GPT-6 Astra

Kwestia dostępnych zasobów obliczeniowych ciągnie się za wdrożeniem od momentu, gdy model trafił do szerokiej dystrybucji na początku września.

Z relacji użytkowników wynika, że OpenAI obcięło limity wykorzystania Astra dla najbardziej aktywnych użytkowników ChatGPT oraz wstrzymało przyjmowanie nowych subskrypcji pakietu Pro za 200 USD miesięcznie. Ten krok Sottiaux potwierdził 10 września. Model nadal kosztuje 10 USD za milion tokenów wejściowych i 50 USD za milion tokenów wyjściowych, czyli 2,5 raza więcej niż Sol w momencie premiery.

To już drugi z rzędu flagowy model OpenAI w ciągu dwóch miesięcy, który spotyka się z tym samym zarzutem ze strony płacących klientów. W lipcu użytkownicy sygnalizowali, że zaawansowany tryb rozumowania w modelu Sol z dnia na dzień spłycił odpowiedzi. Sottiaux odrzucał wtedy sugestie celowego „osłabiania” modelu, przyznając jednocześnie, że firma eksperymentowała z nakładami na rozumowanie.

Przeczytaj również: Jensen Huang z Nvidii: dostawcy rozwiązań bezpieczeństwa korzystają na panice wokół zagrożeń AI

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com i od 10 lat zajmuje się reportażem na temat kryptowalut. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analizie, kontekście branżowym oraz większych siłach kształtujących świat krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Wierzy, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje to, co analogowe, i ciężko pracuje, aby tak się stało.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.
OpenAI wskazuje trzy błędy stojące za nagłym spadkiem formy GPT-6 Astra | Yellow