Alibaba у понеділок представила ШІ‑модель із 2,4 трлн параметрів, що додало її акціям у Гонконгу 7%, тоді як DeepSeek вивів на ринок модель, яка коштує більш ніж у 100 разів дешевше за Anthropic's Claude Fable 5.
Ключові факти:
- Qwen3.8-Max від Alibaba має загалом 2,4 трлн параметрів і активує близько 95 млрд на один запит; відкриті ваги обіцяють оприлюднити вже наступного тижня.
- Акції в Гонконгу закрилися на 7% вище, тоді як депозитарні розписки в Нью-Йорку зросли приблизно на 4% у премаркеті.
- V4-Flash від DeepSeek обходиться приблизно в 3 центи за бенчмарк‑тест проти $3,15 для Claude Fable 5.
Запуск Alibaba Qwen3.8-Max підштовхує котирування
Компанія з Ханчжоу у понеділок представила Qwen3.8-Max і назвала її найпотужнішою моделлю у лінійці Qwen на сьогодні. Модель налічує 2,4 трлн параметрів — налаштувань, які система засвоює з даних, — і за один запит активує близько 95 млрд. Акції Alibaba в Гонконгу закрилися з приростом 7%. Американські депозитарні розписки в Нью-Йорку додавали близько 4% у передбіржових торгах.
Qwen3.8-Max підтримує роботу з текстом, зображеннями та відео й може одночасно обробляти до 1 млн токенів. Alibaba побудувала модель на архітектурі Qwen3.5, використавши підхід mixture-of-experts, у якому під конкретне завдання «прокидається» лише частина мережі.
За словами компанії, система витратила 16 днів лише на розробку інструмента для роботи з командним рядком.
На платформі Arena.AI Qwen3.8-Max показала найкращий результат серед китайських текстових моделей, хоча й поступається Claude Fable 5 та трьом варіантам Opus від Anthropic. У рейтингу моделей, які працюють із зображеннями та іншим візуальним контентом, система посіла друге місце у світі. Відкриті ваги мають вийти наступного тижня — це буде перша Max‑модель у сімействі Qwen з відкритим доступом до параметрів. Alibaba планує викласти їх на Hugging Face та ModelScope.
Також читайте: Інфраструктура ШІ: від мікрокредитів до дата‑центрів у відчаї за $1 млрд
DeepSeek V4-Flash зніжує ціну проти Claude Fable 5
DeepSeek у п’ятницю випустила V4-Flash, встановивши ціну $0,14 за 1 млн вхідних токенів і $0,28 за 1 млн вихідних. За оцінками Artificial Analysis, які вона оприлюднила, середня вартість одного тесту становить близько 3 центів, проти 86 центів у Kimi K3 від Moonshot AI, $1,86 у GPT-5.6 Sol від OpenAI і $3,15 у Claude Fable 5.
«Китайські компанії у сфері ШІ знайшли важливий сегмент ринку», — зазначає головний аналітик дослідницької компанії Omdia Лян Цзє Су, додаючи, що багатьом бізнес‑процесам потрібні насамперед доступні та недорогі рішення.
Цінова війна в китайському ШІ змінює економіку моделей
Відкриті ваги дозволяють розробникам завантажити параметри моделі й адаптувати її під власні задачі — шлях, на який Anthropic, OpenAI та Google поки що не наважилися. V4-Flash набрала 50 балів зі 100 в індексі Artificial Analysis Intelligence Index — стільки ж має Gemini 3.6 Flash від Google.
Kimi K3 отримала 57 балів, тоді як флагманські системи Anthropic та OpenAI випереджають її приблизно на дев’ять пунктів. Дешевша модель виявилася й багатослівнішою, генеруючи приблизно вдвічі більше токенів за медіанний показник тесту.
DeepSeek опинилася в центрі світової уваги на початку 2025 року, коли її моделі R1 і V3 спровокували розпродаж технологічних акцій і поставили під сумнів масштаби витрат США на ШІ. Згодом компанія закріпила зниження цін на 75% як постійне, і відтоді конкуренти — Moonshot, MiniMax, Z.AI, ByteDance та Alibaba — продовжують урізати тарифи.
Читайте далі: Чутки про складаний iPhone: $2 500, без Face ID і без телеоб’єктива






