Qwen3.8-Max против GPT-5.6: 2,4‑триллионный ответ на флагман OpenAI

Pricing and benchmark pressure on OpenAI's GPT-5.6 builds as Alibaba's Qwen3.8-Max lands and Chinese models take 46% of U.S. enterprise tokens. (Image: Shutterstock)
Pricing and benchmark pressure on OpenAI's GPT-5.6 builds as Alibaba's Qwen3.8-Max lands and Chinese models take 46% of U.S. enterprise tokens. (Image: Shutterstock)

Alibaba запустила Qwen3.8-Max с 2,4 трлн параметров на неделе, когда китайские ИИ‑системы уже заняли до 46% трафика токенов в корпоративном сегменте США, усилив давление на OpenAI и её GPT-5.6.

Главное:

  • Qwen3.8-Max от Alibaba — смесь экспертов с суммарно 2,4 трлн параметров и активируемыми 95 млрд на запрос, открытые веса обещаны на следующей неделе.
  • GPT-5.6 Sol по-прежнему лидирует в опубликованном Alibaba бенчмарке для «агентного» программирования, но отрыв минимален и пока не подтверждён независимыми лабораториями.
  • OpenAI 30 июля снизила стоимость базового тарифа на 80% — спустя три недели после запуска линейки GPT-5.6 — на фоне оттока объёмов к китайским моделям.

Qwen3.8-Max выходит на прямое сравнение с GPT-5.6 Sol

Alibaba представила Qwen3.8-Max 3 августа. Это архитектура mixture-of-experts: модель насчитывает 2,4 трлн параметров, но при каждом запросе задействуется лишь около 95 млрд — балансируя между масштабом и стоимостью инференса.

Компания заявила, что уже на следующей неделе выложит открытые веса флагманской версии и облегчённой модели на 27 млрд параметров, фактически свернув период закрытых релизов топовой линейки. В тот же день Alibaba опубликовала полный пакет бенчмарков.

По этим данным, Qwen3.8-Max набирает 86,6 балла в Terminal-Bench 2.1 — тесте агентного программирования, где GPT-5.6 Sol от OpenAI всё ещё остаётся первым с результатом 88,8. В SWE-bench Pro китайская модель получает 67,7 против 80,0 у Claude Fable 5 от Anthropic, а в OSWorld-Verified, бенчмарке на управление компьютером, Qwen3.8-Max заявляет 86,1 балла против 83,2 у Sol.

Независимой валидации этих чисел пока нет. По словам Alibaba, модель в течение 16 дней без участия людей разрабатывала консольный инструмент: принимала пользовательские запросы, превращала их в работающий код и сама же запускала тесты. Разработчики уже поставили под сомнение и демонстрацию, и условия лицензирования.

Также читайте: iPhone 18 Pro Max может стать первым с 2-нм чипом Apple и приростом скорости на 15%

Ион Стоика: отставание Китая сокращается до пары месяцев

Ион Стоика, профессор Калифорнийского университета в Беркли и сооснователь платформы бенчмарков Arena, в конце июля оценил, что открытые китайские модели теперь отстают от американских «фронтирных» лабораторий всего на два–три месяца. Ещё недавно он говорил о лаге в шесть–девять месяцев. Сдвиг совпадает по времени с серией агрессивно открытых релизов от DeepSeek и линейки GLM компании Z.ai.

«Решает цена», — констатирует Харприт Арора, руководящий направлением агентной инфраструктуры в Vercel. По его словам, инженерные команды всё чаще маршрутизируют рутинные задачи в сторону любой достаточно качественной, но дешёвой модели. Джастин Саммервилл из OpenRouter подсчитал, что открытые китайские системы обходятся на 60–90% дешевле. Маршрутизация просто следует за арифметикой.

Ценообразование GPT-5.6: защита объёмного сегмента

OpenAI 30 июля урезала цены тарифа Luna на 80%, всего через три недели после запуска линейки GPT-5.6: до $0,20 за миллион входных токенов и $1,20 за миллион выходных. Тариф Terra подешевел на 20%, тогда как топовый Sol сохранил премиум‑цену — $5 за миллион входа и $30 за миллион выхода.

Такая лестница цен позволяет удерживать флагман в премиум-сегменте, одновременно используя более дешёвые уровни для обороны объёмов, которые китайские лаборатории наращивают весь год.

Модели китайского происхождения выросли с 4,5% до более чем 30% токенного трафика в США на одной из крупных маршрутизирующих платформ: с первой половины 2025 года до устойчивых значений выше 30% каждую неделю с февраля, с пиковым уровнем в 46%. Исследователи Стэнфордского университета зафиксировали отрыв лучшей американской модели в бенчмарках лишь в 2,7 процентного пункта в марте — против максимум 31,6 пункта в 2023‑м.

Читайте далее: Bitcoin может превратить экстремальный страх в топливо для ралли к $75 000

Alexey Bondarev profile photo

Alexey Bondarev

Алексей Бондарев — руководитель отдела контента в Yellow.com, освещающий мир криптовалют на протяжении последних 10 лет. Он специализируется на глубоких исследовательских материалах и обучающих статьях с упором на аналитическую подачу, отраслевой контекст и глобальные силы, формирующие крипторынок — от эры искусственного интеллекта и технологий безопасности до инноваций в финтехе. Он убеждён, что всё цифровое в скором времени окончательно превзойдёт всё аналоговое, и усердно работает над тем, чтобы это стало реальностью.

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Последние новости
Показать все новости
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи
Qwen3.8-Max против GPT-5.6: 2,4‑триллионный ответ на флагман OpenAI | Yellow