Alibaba запустила Qwen3.8-Max с 2,4 трлн параметров на неделе, когда китайские ИИ‑системы уже заняли до 46% трафика токенов в корпоративном сегменте США, усилив давление на OpenAI и её GPT-5.6.
Главное:
- Qwen3.8-Max от Alibaba — смесь экспертов с суммарно 2,4 трлн параметров и активируемыми 95 млрд на запрос, открытые веса обещаны на следующей неделе.
- GPT-5.6 Sol по-прежнему лидирует в опубликованном Alibaba бенчмарке для «агентного» программирования, но отрыв минимален и пока не подтверждён независимыми лабораториями.
- OpenAI 30 июля снизила стоимость базового тарифа на 80% — спустя три недели после запуска линейки GPT-5.6 — на фоне оттока объёмов к китайским моделям.
Qwen3.8-Max выходит на прямое сравнение с GPT-5.6 Sol
Alibaba представила Qwen3.8-Max 3 августа. Это архитектура mixture-of-experts: модель насчитывает 2,4 трлн параметров, но при каждом запросе задействуется лишь около 95 млрд — балансируя между масштабом и стоимостью инференса.
Компания заявила, что уже на следующей неделе выложит открытые веса флагманской версии и облегчённой модели на 27 млрд параметров, фактически свернув период закрытых релизов топовой линейки. В тот же день Alibaba опубликовала полный пакет бенчмарков.
По этим данным, Qwen3.8-Max набирает 86,6 балла в Terminal-Bench 2.1 — тесте агентного программирования, где GPT-5.6 Sol от OpenAI всё ещё остаётся первым с результатом 88,8. В SWE-bench Pro китайская модель получает 67,7 против 80,0 у Claude Fable 5 от Anthropic, а в OSWorld-Verified, бенчмарке на управление компьютером, Qwen3.8-Max заявляет 86,1 балла против 83,2 у Sol.
Независимой валидации этих чисел пока нет. По словам Alibaba, модель в течение 16 дней без участия людей разрабатывала консольный инструмент: принимала пользовательские запросы, превращала их в работающий код и сама же запускала тесты. Разработчики уже поставили под сомнение и демонстрацию, и условия лицензирования.
Также читайте: iPhone 18 Pro Max может стать первым с 2-нм чипом Apple и приростом скорости на 15%
Ион Стоика: отставание Китая сокращается до пары месяцев
Ион Стоика, профессор Калифорнийского университета в Беркли и сооснователь платформы бенчмарков Arena, в конце июля оценил, что открытые китайские модели теперь отстают от американских «фронтирных» лабораторий всего на два–три месяца. Ещё недавно он говорил о лаге в шесть–девять месяцев. Сдвиг совпадает по времени с серией агрессивно открытых релизов от DeepSeek и линейки GLM компании Z.ai.
«Решает цена», — констатирует Харприт Арора, руководящий направлением агентной инфраструктуры в Vercel. По его словам, инженерные команды всё чаще маршрутизируют рутинные задачи в сторону любой достаточно качественной, но дешёвой модели. Джастин Саммервилл из OpenRouter подсчитал, что открытые китайские системы обходятся на 60–90% дешевле. Маршрутизация просто следует за арифметикой.
Ценообразование GPT-5.6: защита объёмного сегмента
OpenAI 30 июля урезала цены тарифа Luna на 80%, всего через три недели после запуска линейки GPT-5.6: до $0,20 за миллион входных токенов и $1,20 за миллион выходных. Тариф Terra подешевел на 20%, тогда как топовый Sol сохранил премиум‑цену — $5 за миллион входа и $30 за миллион выхода.
Такая лестница цен позволяет удерживать флагман в премиум-сегменте, одновременно используя более дешёвые уровни для обороны объёмов, которые китайские лаборатории наращивают весь год.
Модели китайского происхождения выросли с 4,5% до более чем 30% токенного трафика в США на одной из крупных маршрутизирующих платформ: с первой половины 2025 года до устойчивых значений выше 30% каждую неделю с февраля, с пиковым уровнем в 46%. Исследователи Стэнфордского университета зафиксировали отрыв лучшей американской модели в бенчмарках лишь в 2,7 процентного пункта в марте — против максимум 31,6 пункта в 2023‑м.
Читайте далее: Bitcoin может превратить экстремальный страх в топливо для ралли к $75 000






