OpenAI usunęło trzy kluczowe usterki, które stały za tygodniem skarg użytkowników, iż nowy model GPT-6 Astra „zgłupiał” po premierze. Firma jednocześnie resetuje limity wykorzystania dla subskrybentów pakietu Codex.
Najważniejsze informacje:
- Użytkownicy Astra przez cały tydzień publikowali testy porównawcze, sugerując, że model został po cichu osłabiony po starcie.
- Szef Codex w OpenAI wskazał trzy główne przyczyny, w tym eksperyment z kontekstem, który objął ok. 4–5 tys. użytkowników.
- Poprzedni flagowy model firmy, GPT-5.6 Sol, był w lipcu oskarżany o dokładnie to samo.
OpenAI łata błędy jakościowe w Astra
Szef produktu Codex, Tibo Sottiaux, poinformował, że zespół wspólnie z użytkownikami zidentyfikował źródła problemów, wdrożył poprawki oraz pełny reset wykorzystania jeszcze przed północą czasu lokalnego. Szczegóły podał w aktualizacji opublikowanej w sobotę. Umiejętności przygotowane pierwotnie dla starszych modeli uruchamiały się zbyt często, w praktyce uniemożliwiając Astra weryfikację własnych odpowiedzi.
Dodatkowo dobrowolny eksperyment z zarządzaniem kontekstem mógł powodować przedwczesne ucinanie odpowiedzi lub reaktywowanie się na przestarzałe wiadomości. OpenAI wyłączyło ten eksperyment po tym, jak dotknął on szacunkowo 4–5 tys. użytkowników testu. Część silników była też źle skonfigurowana, co mierzalnie pogarszało jakość na „ogonowym” ruchu kierowanym przez te instancje. Firma usunęła te silniki i przeprowadziła szereg mniejszych napraw. Jak napisał Sottiaux we wpisie w serwisie X, model lepiej śledzi teraz najnowszą wiadomość użytkownika.
Zobacz także: Ethereum mierzy się z barierą podaży przy 2 800 USD po skoku napływów do ETF do 216 mln USD
Użytkownicy Astra zgłaszają regres w jakości kodu
W ciągu tygodnia narastała fala skarg w serwisie X. Programiści uruchamiali identyczne prompty na wersji Astra z dnia premiery oraz na aktualnej odsłonie modelu, zachowując takie same ustawienia, a następnie porównywali wyniki. Deweloper Pranjal Paliwal, który jeszcze kilka dni wcześniej chwalił model, wrócił do wygenerowanego przez Astra kodu i ocenił, że zamiast postępu widać tu regres.
Dax Raad, twórca narzędzia programistycznego Opencode, po testach zdecydował się przywrócić w swoim zespole starszy model GPT-5.6 Sol. Koszt korzystania z Astra praktycznie się podwoił, a – jego zdaniem – dodatkowe wydatki nie przekładały się na adekwatne korzyści.
Jeden z użytkowników forum opisał, że Astra w obecnej formie jest zaledwie „na równi” z modelem Sol przy tych samych zadaniach i liczbie ponowień. Nie wszyscy podzielali tę opinię: anonimowy użytkownik piszący jako Antikythera argumentował, że model od początku był „leniwy” i miał skłonność do list punktowanych, a użytkownicy po prostu przestali się zachwycać.
Limity mocy obliczeniowej cieniem na GPT-6 Astra
Kwestia dostępnych zasobów obliczeniowych ciągnie się za wdrożeniem od momentu, gdy model trafił do szerokiej dystrybucji na początku września.
Z relacji użytkowników wynika, że OpenAI obcięło limity wykorzystania Astra dla najbardziej aktywnych użytkowników ChatGPT oraz wstrzymało przyjmowanie nowych subskrypcji pakietu Pro za 200 USD miesięcznie. Ten krok Sottiaux potwierdził 10 września. Model nadal kosztuje 10 USD za milion tokenów wejściowych i 50 USD za milion tokenów wyjściowych, czyli 2,5 raza więcej niż Sol w momencie premiery.
To już drugi z rzędu flagowy model OpenAI w ciągu dwóch miesięcy, który spotyka się z tym samym zarzutem ze strony płacących klientów. W lipcu użytkownicy sygnalizowali, że zaawansowany tryb rozumowania w modelu Sol z dnia na dzień spłycił odpowiedzi. Sottiaux odrzucał wtedy sugestie celowego „osłabiania” modelu, przyznając jednocześnie, że firma eksperymentowała z nakładami na rozumowanie.
Przeczytaj również: Jensen Huang z Nvidii: dostawcy rozwiązań bezpieczeństwa korzystają na panice wokół zagrożeń AI

