Alibaba в понедельник представила ИИ‑модель с 2,4 трлн параметров, что подняло ее акции в Гонконге на 7%, в то время как DeepSeek сбил цену Anthropic Claude Fable 5 более чем в 100 раз.
Главное:
- Qwen3.8-Max от Alibaba насчитывает 2,4 трлн параметров и активирует около 95 млрд на один запрос; открытые веса обещаны на следующей неделе.
- Акции в Гонконге закрылись ростом на 7%, американские депозитарные расписки в Нью‑Йорке прибавляли порядка 4% до открытия.
- V4-Flash от DeepSeek обходится примерно в 3 цента за тестовый прогон против $3,15 у Claude Fable 5.
Запуск Alibaba Qwen3.8-Max разогревает котировки
Ханчжоуская компания представила Qwen3.8-Max в понедельник, назвав ее самым продвинутым решением в линейке Qwen. Модель оперирует совокупно 2,4 трлн параметров — тех самых настроек, которые формируются при обучении на данных, — и задействует порядка 95 млрд при каждом отдельном запросе. Акции Alibaba в Гонконге закрылись ростом на 7%. Американские депозитарные расписки в Нью‑Йорке на премаркете прибавляли около 4%.
Qwen3.8-Max поддерживает работу с текстом, изображениями и видео и способна обрабатывать до 1 млн токенов за один заход. Модель построена на архитектуре Qwen3.5 с применением смеси экспертов — подхода, при котором активируется лишь часть сети.
По словам компании, система потратила 16 дней только на разработку одного консольного инструмента.
Qwen3.8-Max заняла первое место среди китайских текстовых моделей на площадке Arena.AI, хотя по‑прежнему отстает от Claude Fable 5 и трех вариантов Opus от Anthropic. В рейтинге мультимодальных моделей, работающих с изображениями и другой визуальной информацией, система оказалась второй в мире. Открытые веса должны выйти на следующей неделе — это будет первый релиз такого рода для Qwen класса Max. Alibaba планирует выложить их на Hugging Face и ModelScope.
Читайте также: ИИ‑инфраструктура: отчаянный поворот микрофинансового игрока на $1 млрд к дата‑центрам
DeepSeek V4-Flash давит на цены Claude Fable 5
DeepSeek в пятницу вывела на рынок модель V4-Flash, установив тариф $0,14 за миллион входных токенов и $0,28 за миллион выходных. По оценке Artificial Analysis (расчет), средняя стоимость одного бенчмарка составляет около 3 центов — против 86 центов у Kimi K3 от Moonshot AI, $1,86 у GPT-5.6 Sol от OpenAI и $3,15 у Claude Fable 5.
«Китайские ИИ‑компании нашли для себя ключевой рынок», — говорит главный аналитик исследовательской компании Omdia Лян Цзай Су (Lian Jye Su), отмечая, что многим корпоративным процессам нужен прежде всего доступный и массовый, а не самый топовый по качеству ИИ.
Ценовая война в китайском ИИ меняет экономику моделей
Выпуск моделей с открытыми весами позволяет разработчикам скачивать параметры и дообучать систему под свои задачи — на шаг, на который пока не пошли Anthropic, OpenAI и Google. V4-Flash набрал 50 из 100 баллов в индексе Artificial Analysis Intelligence Index — столько же, сколько Gemini 3.6 Flash от Google.
Kimi K3 получила 57 баллов, а флагманские системы Anthropic и OpenAI оказались примерно на девять пунктов выше. При этом дешевая модель показала избыточную многословность, генерируя примерно вдвое больше токенов, чем медианное значение в тесте.
DeepSeek привлекла внимание мировых рынков еще в начале 2025 года, когда ее модели R1 и V3 спровоцировали распродажу в технологическом секторе и поставили под вопрос масштабы американских трат на ИИ. Позже компания закрепила 75‑процентное снижение цен как постоянное, а конкуренты — включая Moonshot, MiniMax, Z.AI, ByteDance и Alibaba — с тех пор продолжают следом урезать тарифы.
Читайте далее: Слухи о складном iPhone: $2 500, без Face ID и без телеобъектива






