Alibaba в понедельник представила ИИ‑модель с 2,4 трлн параметров, что подтолкнуло ее бумаги в Гонконге вверх на 7%. Одновременно DeepSeek вышла на рынок с агрессивным ценообразованием, предложив альтернативу Anthropic’s Claude Fable 5 более чем в 100 раз дешевле по себестоимости.
Ключевые факты:
- Qwen3.8-Max от Alibaba насчитывает 2,4 трлн параметров и задействует около 95 млрд на один запрос; открытые веса обещаны на следующую неделю.
- Акции в Гонконге закрылись ростом на 7%, депозитарные расписки в Нью‑Йорке подорожали примерно на 4% на предварительных торгах.
- DeepSeek V4-Flash обходится примерно в $0,03 за один бенчмарк‑тест против $3,15 для Claude Fable 5.
Запуск Alibaba Qwen3.8-Max поддержал котировки
Ханчжоуская компания в понедельник представила Qwen3.8-Max, назвав ее самой продвинутой системой в линейке Qwen. Модель насчитывает 2,4 трлн параметров — числовых настроек, которые система получает в ходе обучения, — и активирует порядка 95 млрд на каждый отдельный запрос. Акции Alibaba в Гонконге по итогам сессии прибавили 7%. Американские депозитарные расписки в Нью‑Йорке дорожали примерно на 4% на премаркете.
Qwen3.8-Max работает с текстом, изображениями и видеоконтентом, принимая до 1 млн токенов за один заход. Alibaba построила модель на базе архитектуры Qwen3.5, применив схему Mixture‑of‑Experts, при которой в ответ на запрос «просыпаются» только части нейросети.
По словам компании, система за 16 дней создала отдельный инструмент командной строки.
На площадке Arena.AI Qwen3.8-Max стала лучшей среди китайских текстовых моделей, хотя пока уступает Claude Fable 5 и трем вариантам Opus от Anthropic. В рейтинге моделей, работающих с изображениями и другим визуальным контентом, система заняла второе место в мире. Открытые веса обещаны на следующей неделе — это первый подобный релиз для модели уровня Max в семействе Qwen. Alibaba планирует выложить их на Hugging Face и ModelScope.
Также по теме: ИИ‑инфраструктура: отчаянный $1 млрд‑поворот микрофинансового кредитора к дата‑центрам
DeepSeek V4-Flash снижает планку цен для Claude Fable 5
DeepSeek в пятницу выпустила модель V4-Flash, установив тарифы в $0,14 за 1 млн входных токенов и $0,28 за 1 млн выходных. По оценке компании Artificial Analysis (данные), средняя стоимость одного теста составляет около $0,03 против $0,86 у Kimi K3 от Moonshot AI, $1,86 у GPT-5.6 Sol от OpenAI и $3,15 у Claude Fable 5.
«Китайские ИИ‑компании нашли важный сегмент рынка», — отметил главный аналитик исследовательской фирмы Omdia Лян Цзе Су (Lian Jye Su), подчеркнув, что многим бизнес‑процессам нужен в первую очередь доступный и недорогой инструмент.
Ценовая война в китайском ИИ меняет экономику моделей
Выпуск моделей с открытыми весами позволяет разработчикам скачивать параметры и донастраивать систему под свои задачи — путь, на который пока не решились Anthropic, OpenAI и Google. V4-Flash получила 50 баллов из 100 в индексе Artificial Analysis Intelligence Index — столько же, сколько Gemini 3.6 Flash от Google.
Kimi K3 набрала 57 баллов, а флагманские решения Anthropic и OpenAI опередили ее примерно на девять пунктов. При этом более дешевая V4-Flash оказалась «многословнее», генерируя примерно вдвое больше токенов, чем медианное значение в тесте.
К DeepSeek приковано внимание с начала 2025 года, когда ее модели R1 и V3 спровоцировали распродажу технологических акций и поставили под вопрос масштабы расходов США на ИИ. Позднее компания закрепила 75‑процентное снижение цен, и конкуренты — включая Moonshot, MiniMax, Z.AI, ByteDance и Alibaba — с тех пор продолжают урезать тарифы.
Читайте далее: Слухи о складном iPhone становятся конкретнее: $2 500, без Face ID и без телеобъектива






