Alibaba apresentou na segunda-feira um modelo de IA com 2,4 trilhões de parâmetros, impulsionando em 7% suas ações em Hong Kong, enquanto a DeepSeek lançou um sistema que cobra pouco mais de 3 centavos de dólar por teste de benchmark, contra US$ 3,15 do Claude Fable 5 da Anthropic.
Principais pontos:
- O Qwen3.8-Max, da Alibaba, soma 2,4 trilhões de parâmetros e ativa cerca de 95 bilhões por consulta; os pesos abertos saem na próxima semana.
- As ações em Hong Kong fecharam em alta de 7%, enquanto os recibos listados em Nova York subiam cerca de 4% no pré-mercado.
- O V4-Flash, da DeepSeek, custa cerca de US$ 0,03 por teste de benchmark, contra US$ 3,15 do Claude Fable 5.
Lançamento do Qwen3.8-Max impulsiona ações da Alibaba
A empresa de Hangzhou lançou o Qwen3.8-Max na segunda-feira, classificando-o como o modelo mais avançado de toda a família Qwen até agora. O sistema reúne 2,4 trilhões de parâmetros — os ajustes que a IA aprende a partir dos dados — e ativa aproximadamente 95 bilhões em cada consulta. As ações da Alibaba em Hong Kong fecharam em alta de 7%. Os recibos de depósito americanos subiam cerca de 4% no pré-mercado em Nova York.
O Qwen3.8-Max é multimodal: processa texto, imagens e vídeo, com capacidade de entrada de até 1 milhão de tokens por vez. A Alibaba desenvolveu o modelo a partir da arquitetura Qwen3.5, usando um desenho “mixture of experts”, em que apenas parte da rede é ativada a cada tarefa.
Segundo a companhia, o sistema levou 16 dias apenas para desenvolver uma ferramenta de linha de comando.
O Qwen3.8-Max aparece como o modelo de texto chinês mais bem colocado no ranking da Arena.AI, embora ainda fique atrás do Claude Fable 5 e de três variantes Opus da Anthropic. No ranking da plataforma para modelos que interpretam imagens e outros dados visuais, o sistema alcançou a segunda posição global. Os pesos abertos serão publicados na próxima semana, a primeira vez que um modelo da classe Max da Qwen terá esse nível de abertura. A Alibaba pretende disponibilizá-los no Hugging Face e no ModelScope.
Veja também: Infraestrutura de IA: a aposta desesperada de US$ 1 bi de uma financeira para dominar data centers
DeepSeek V4-Flash pressiona preços do Claude Fable 5
A DeepSeek lançou o V4-Flash na sexta-feira, cobrando US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída. A consultoria Artificial Analysis estimou o custo médio em cerca de US$ 0,03 por teste de benchmark, ante US$ 0,86 do Kimi K3, da Moonshot AI, US$ 1,86 do GPT-5.6 Sol, da OpenAI, e US$ 3,15 do Claude Fable 5, da Anthropic.
“As empresas chinesas de IA encontraram um mercado importante”, disse Lian Jye Su, analista-chefe da consultoria Omdia, destacando que muitos fluxos de trabalho corporativos precisam apenas de um sistema acessível e barato, não necessariamente do mais sofisticado.
Guerra de preços em IA na China redefine economia dos modelos
Modelos com pesos abertos permitem que desenvolvedores baixem e adaptem os parâmetros de treino, um caminho que Anthropic, OpenAI e Google ainda não seguiram. O V4-Flash marcou 50 pontos de 100 no Índice de Inteligência da Artificial Analysis, desempenho equivalente ao Gemini 3.6 Flash, do Google.
O Kimi K3 alcançou 57 pontos, enquanto os modelos carro-chefe de Anthropic e OpenAI ficaram cerca de nove pontos acima disso. O V4-Flash, mais barato, também se mostrou mais prolixo, gerando aproximadamente o dobro do volume mediano de tokens durante os testes.
A DeepSeek chamou atenção global no início de 2025, quando seus modelos R1 e V3 desencadearam uma onda de vendas em ações de tecnologia e levantaram dúvidas sobre o ritmo de gastos dos Estados Unidos em IA. Depois, a empresa tornou permanente um corte de 75% nos preços, e rivais como Moonshot, MiniMax, Z.AI, ByteDance e a própria Alibaba vêm reduzindo tarifas desde então.
Leia a seguir: Boatos sobre iPhone dobrável ganham detalhes: US$ 2.500, sem Face ID e sem teleobjetiva






