OpenAI 1 sierpnia potwierniło nazwę Astra jako kolejnej dużej rodziny modeli – to wciąż niewydany system, który rozwiązał 10 zadań matematycznych, ogłoszony tydzień po premierze Claude Opus 5 od Anthropic.
Kluczowe informacje:
- OpenAI potwierdziło nazwę Astra 1 sierpnia w publikacji badawczej opisującej dziesięć rozwiązanych problemów z matematyki.
- Astra koordynuje pracę wielu agentów nad jednym problemem przez wiele godzin, a nawet dni; model pozostaje niewydany i bez daty premiery.
- Claude Opus 5 zadebiutował 24 lipca z ceną 5 i 25 dol. za milion tokenów oraz kontekstem na 1 mln tokenów.
Szczegóły modelu OpenAI Astra
OpenAI ogłosiło nazwę Astra w artykule badawczym, przypisując wewnętrznej wersji tego modelu dziesięć wyników z matematyki i teorii informatyki, z których każdy pozostawał otwartym problemem od co najmniej dekady. Prace obejmują m.in. geometrię wysokowymiarową, teorię kodowania i złożoność kwantową, a jedno z rozwiązań dowodzi istnienia grup niesoficznych.
Narracja wokół Astra akcentuje czas trwania obliczeń, a nie surową szybkość: model koordynuje kilka agentów pracujących nad jednym problemem łącznie przez godziny lub dni.
Wcześniejsze doniesienia lokalizowały Astrę obok rodzin Sol, Terra i Luna, bez wyznaczonej daty wydania oraz bez decyzji, czy otrzyma oznaczenie GPT‑6, czy np. GPT‑5.7. Sam Altman prezentował system decydentom w Waszyngtonie, a rodzina ta ma być prawdopodobnie pierwszą ocenianą w ramach planowanego federalnego systemu zatwierdzania.
Zobacz też: Infrastruktura AI, desperacki zwrot parabanku o 1 mld dol. w kierunku centrów danych
Ceny i wyniki testów Claude Opus 5
Anthropic wprowadził Claude Opus 5 na rynek 24 lipca, ustalając cenę na 5 dol. za milion tokenów wejściowych i 25 dol. za milion tokenów wyjściowych – tyle samo, co w przypadku Opus 4.8. Model zajął pierwsze miejsce w Artificial Analysis Intelligence Index z wynikiem 61 punktów, przy szacunkowo około dwukrotnie niższym koszcie pojedynczego zadania niż Fable 5.
Model obsługuje kontekst na poziomie 1 mln tokenów, a długość pojedynczej odpowiedzi ogranicza do 128 000 tokenów. Uzyskał 30,2% na ARC‑AGI‑3 – około trzykrotność kolejnego najlepszego opublikowanego wyniku – oraz 89,1% na Terminal‑Bench 2.1 przy maksymalnym wysiłku obliczeniowym. Rzecznik Anthropic zalecił klientom przetestowanie konkurencyjnych modeli na jednym ograniczonym zadaniu i jednym projekcie długoterminowym przed podjęciem decyzji zakupowej.
Reakcje ekspertów na Astrę
Astra nie ma jeszcze publicznie ogłoszonej ceny, tabel z benchmarkami ani niezależnych testów. Dla klientów oznacza to wybór między dostępnych komercyjnie produktem a obietnicą wyników naukowych.
Thomas Bloom, matematyk z University of Manchester, określił dziesięć wyników jako „wielką wiadomość” na platformie X i ocenił je wyżej niż wcześniejsze dowody OpenAI.
Bloom odrzucił też sugestie, że model zastępuje matematyków, podkreślając, że to ludzie go zbudowali i wytrenowali na dorobku całego środowiska matematycznego. Noam Brown, badacz w OpenAI, zaznaczył, że Astra nie rozwiązała żadnego z Problemów Milenijnych i że zespół nie przeznaczał na pojedyncze zadania ogromnych budżetów obliczeniowych.
Kognitywista Gary Marcus argumentował, że wyniki są realne, ale w mediach zostały „mocno przereklamowane” jako dowód na całkowite rozwiązanie dziedziny.
Ogłoszenie następuje po majowym osiągnięciu z tej samej „długohoryzontowej” rodziny modeli, które obaliło hipotezę Erdősa o odległości jednostkowej – 80‑letni problem z geometrii dyskretnej. Laureat Medalu Fieldsa Tim Gowers stwierdził wówczas, że bez wahania rekomendowałby ten dowód do publikacji w „Annals of Mathematics”.
Czytaj dalej: Plotki o składanym iPhonie nabierają konkretów: 2 500 dol., bez Face ID i bez teleobiektywu






