Alibaba у понеділок представила модель штучного інтелекту на 2,4 трлн параметрів, що додало її паперам у Гонконзі 7%, тоді як DeepSeek вийшла з продуктом, який за собівартістю більш ніж у сто разів дешевший за Claude Fable 5 від Anthropic.
Ключові факти:
- Qwen3.8-Max від Alibaba має загалом 2,4 трлн параметрів та активує близько 95 млрд на один запит; відкриті ваги обіцяють опублікувати вже наступного тижня.
- Акції в Гонконзі закрилися з ростом на 7%, а американські депозитарні розписки в Нью-Йорку додали близько 4% на передринкових торгах.
- V4-Flash від DeepSeek обходиться приблизно в 3 центи за тест у бенчмарку проти $3,15 для Claude Fable 5.
Запуск Alibaba Qwen3.8-Max підштовхує котирування
Компанія з Ханчжоу у понеділок представила Qwen3.8-Max і назвала її найпотужнішою моделлю лінійки Qwen. Система налічує 2,4 трлн параметрів — це налаштування, які модель засвоює з даних, — і за один запит активує близько 95 млрд. На цьому тлі акції Alibaba в Гонконзі закрилися із ростом на 7%. Американські депозитарні розписки в Нью-Йорку піднімалися приблизно на 4% у премаркеті.
Qwen3.8-Max працює з текстом, зображеннями та відео й здатна обробляти до 1 млн токенів в одному запиті. Модель побудована на архітектурі Qwen3.5 із використанням підходу “mixture of experts”, який задіює лише частину мережі замість повного розгортання всіх параметрів.
За даними компанії, система витратила 16 днів лише на розробку інструмента командного рядка.
На платформі Arena.AI Qwen3.8-Max стала найкращою китайською текстовою моделлю, хоча все ще поступається Claude Fable 5 і трьом версіям Opus від Anthropic. У рейтингу моделей, що працюють із зображеннями та іншими видами візуальних даних, система посіла друге місце у світі. Відкриті ваги мають з’явитися наступного тижня — це буде перший реліз у форматі open weights для моделі класу Max у лінійці Qwen. Alibaba планує викласти їх на Hugging Face і ModelScope.
Читайте також: AI‑інфраструктура: від мікрокредитів до $1 млрд ставки на дата‑центри
DeepSeek V4-Flash ламає цінник Claude Fable 5
DeepSeek у п’ятницю вивела на ринок V4-Flash із тарифом $0,14 за 1 млн вхідних токенів і $0,28 за 1 млн вихідних. Аналітична платформа Artificial Analysis оцінює середню вартість одного тесту приблизно в 3 центи, тоді як для Kimi K3 від Moonshot AI вона становить 86 центів, для GPT-5.6 Sol від OpenAI — $1,86, а для Claude Fable 5 — $3,15.
«Китайські AI‑компанії знайшли важливий сегмент ринку, — зазначає головний аналітик дослідницької компанії Omdia Лян Цзи Су (Lian Jye Su). — Для багатьох бізнес-процесів достатньо, аби система була доступною за ціною й простою у впровадженні».
Цінова війна в китайському AI змінює економіку моделей
Випуск моделей з відкритими вагами дозволяє розробникам завантажувати базові налаштування та адаптувати їх під власні задачі — шлях, на який поки що не наважилися Anthropic, OpenAI та Google. V4-Flash набрала 50 балів зі 100 в індексі Artificial Analysis Intelligence Index — стільки ж має Gemini 3.6 Flash від Google.
Kimi K3 отримала 57 балів, тоді як флагманські моделі Anthropic та OpenAI показали результати приблизно на дев’ять пунктів вищі. Водночас V4-Flash виявилася доволі «балакучою», генеруючи близько вдвічі більше токенів, ніж медіанний показник у тесті.
DeepSeek вперше голосно заявила про себе на світовій арені на початку 2025 року, коли її моделі R1 і V3 спровокували розпродаж акцій технологічних компаній і поставили під сумнів ефективність витрат США на AI. Згодом компанія зробила 75‑відсоткове зниження цін постійним, а конкуренти — Moonshot, MiniMax, Z.AI, ByteDance та Alibaba — з того часу продовжують урізати тарифи.
Читати далі: Чутки про складаний iPhone: $2 500, без Face ID і без телеоб’єктива






