OpenAI 1 серпня підтвердила Astra як наступне велике сімейство моделей — нерелізовану систему, що розв'язала 10 математичних задач. Анонс прозвучав лише за тиждень після виходу Claude Opus 5 від Anthropic.
Ключові акценти:
- OpenAI підтвердила назву Astra 1 серпня у дослідницькій публікації з описом десяти розв'язаних математичних задач.
- Astra координує роботу кількох агентів над однією задачею протягом годин або днів і поки що лишається нерелізованою без оголошеної дати запуску.
- Claude Opus 5 вийшов 24 липня з тарифами $5 і $25 за мільйон токенів та контекстним вікном у 1 млн токенів.
Деталі моделі OpenAI Astra
OpenAI оголосила назву у науковому дописі, приписавши внутрішній версії Astra десять результатів у математиці та теоретичній інформатиці, кожен з яких залишався відкритим щонайменше десятиліття. Дослідження охоплюють багатовимірну геометрію, теорію кодів та квантову складність, а одна з робіт доводить існування не-софічних груп.
Ключова відмінність — не «сирий» швидкісний перформанс, а тривалість: Astra координує кількох агентів, які працюють над однією задачею спільно годинами або навіть днями.
Попередні публікації розміщували Astra поруч із сімействами Sol, Terra та Luna, без затвердженої дати релізу й без рішення, чи отримає вона брендинг GPT-6 або GPT-5.7. Сем Альтман демонстрував систему американським політикам у Вашингтоні, а сімейство Astra очікують як перший кандидат на перевірку за запланованою федеральною процедурою попереднього схвалення.
Також читайте: Інфраструктура ШІ: від мікрофінансового кредитора до гравця дата-центрів на $1 млрд
Ціни та бенчмарки Claude Opus 5
Anthropic запустила Claude Opus 5 24 липня з тарифами $5 за мільйон вхідних токенів і $25 за мільйон вихідних — на рівні Opus 4.8. Модель очолила індекс Artificial Analysis Intelligence з результатом 61 бал, виконуючи завдання приблизно вдвічі дешевше, ніж Fable 5.
Claude Opus 5 підтримує контекстне вікно в 1 млн токенів із лімітом вихідного тексту 128 000 токенів. Модель показала 30,2% на ARC-AGI-3 — приблизно утричі вище за наступний оприлюднений результат — і 89,1% на Terminal-Bench 2.1 у режимі максимальної складності. Представник Anthropic рекомендував корпоративним клієнтам прогнати конкурентні моделі на одному чітко обмеженому завданні та одному довгостроковому кейсі перед вибором постачальника.
Реакція експертів на Astra
На відміну від Claude Opus 5, Astra не має ані опублікованих цін, ані бенчмарк-таблиць, ані незалежних випробувань. Замовники наразі змушені зважувати реальний комерційний продукт проти амбітної наукової заяви.
Математик Манчестерського університету Томас Блум назвав десять результатів «великою новиною» у X та оцінив їх вище за попередні досягнення OpenAI в області доказів.
Водночас Блум застеріг від тверджень, що модель замінює математиків: її створили люди, навчивши на всьому корпусі праць, які ті написали. Дослідник OpenAI Ноам Браун відзначив, що команда не розв'язала жодної з задач тисячоліття та не витрачала великі бюджети на кожну окрему задачу.
Когнітивний науковець Гарі Маркус погодився, що результати реальні, але, на його думку, їх подають надмірно тріумфально — як нібито питання вже закрите для всієї галузі.
Оголошення продовжує лінію травневого прориву з того ж «довгогрального» сімейства моделей, коли система спростувала здогадку Ерьоша про одиничні відстані — задачу в дискретній геометрії, якій понад 80 років. Лауреат Філдсівської премії Тім Гауерс тоді заявив, що без вагань рекомендував би цей доказ до публікації в Annals of Mathematics.
Читайте далі: Чутки про складаний iPhone: $2 500, без Face ID і без телеоб'єктива






