OpenAI 1 августа подтвердила Astra как следующее крупное семейство моделей — это ещё не вышедшая система, решившая 10 математических задач, представленная спустя неделю после релиза Claude Opus 5 от Anthropic.
Ключевые моменты:
- OpenAI официально закрепила название Astra 1 августа в исследовательской статье, где описаны десять решённых задач по математике.
- Astra координирует работу нескольких агентов над одной задачей в течение часов или даже дней и пока не имеет ни даты релиза, ни коммерческой версии.
- Claude Opus 5 вышел 24 июля с ценой $5 и $25 за миллион токенов и контекстным окном на 1 млн токенов.
Детали модели OpenAI Astra
OpenAI раскрыла название в научной работе, приписывающей внутренней версии Astra десять результатов в математике и теоретической информатике — задачи, которые оставались открытыми не менее десяти лет. Исследование охватывает многомерную геометрию, теорию кодирования и квантовую сложность; одна из доказанных теорем устанавливает существование не-софических групп.
Ключевая «фишка» Astra — не скорость, а длительность вычислений: модель координирует несколько специализированных агентов, которые совместно работают над одной задачей часами или даже сутками.
Ранее источники сообщали, что Astra станет в один ряд с семействами Sol, Terra и Luna. У модели до сих пор нет объявленной даты выхода и даже финального решения, будет ли она маркироваться как GPT‑6 или, например, GPT‑5.7. Сэм Альтман уже демонстрировал систему американским законодателям в Вашингтоне, и ожидается, что именно это семейство первым пройдёт рассмотрение по планируемой федеральной процедуре одобрения ИИ‑систем.
Также по теме: AI‑инфраструктура: отчаянный разворот микрофинансового кредитора на $1 млрд в сторону дата‑центров
Цены и бенчмарки Claude Opus 5
Anthropic запустила Claude Opus 5 24 июля по цене $5 за миллион входных токенов и $25 за миллион выходных — то же, что и для Opus 4.8. На тестах он возглавил индекс Artificial Analysis Intelligence с результатом 61 балл, при этом обходится примерно вдвое дешевле за задачу, чем Fable 5.
Модель поддерживает контекстное окно в 1 млн токенов и максимум 128 000 токенов на вывод. На бенчмарке ARC‑AGI‑3 она набрала 30,2% — примерно втрое больше следующего опубликованного результата, а на Terminal‑Bench 2.1 при максимальных настройках — 89,1%. Представитель Anthropic рекомендовал корпоративным заказчикам перед выбором провести как минимум два сравнения: одно на чётко ограниченной задаче и одно на проекте с длинным горизонтом.
Как рынок встречает Astra
У Astra нет ни объявленных тарифов, ни таблиц с бенчмарками, ни независимых тестов. Клиентам фактически приходится сравнивать готовый коммерческий продукт с пока что исследовательским заявлением о прорыве.
Математик Манчестерского университета Томас Блум назвал десять результатов «большой новостью» в X и оценил их выше предыдущего доказательства от OpenAI.
При этом Блум раскритиковал тезисы о том, что модель «заменяет математиков»: по его словам, систему создали люди и обучили на всём массиве работ, написанных математиками. Исследователь OpenAI Ноам Браун отметил, что ни одна из задач не относится к Призам тысячелетия и что на каждую задачу команда тратила относительно небольшие вычислительные бюджеты.
Когнитивный учёный Гэри Маркус считает, что математические результаты реальны, но поданы как «победа над всей областью» и сильно переоценены в публичном дискурсе.
Анонс следует за майским результатом из того же «дальнобойного» направления моделей OpenAI: тогда системе удалось опровергнуть гипотезу Эрдёша о единичных расстояниях — задачу дискретной геометрии, над которой бились около 80 лет. Лауреат медали Филдса Тим Гауэрс заявлял, что без колебаний порекомендовал бы это доказательство в Annals of Mathematics.
Читать далее: Складной iPhone: всё конкретнее слухи о $2 500, без Face ID и без телеобъектива






