Alibaba revelou na segunda-feira um modelo de IA com 2,4 trilhões de parâmetros, impulsionando em 7% suas ações em Hong Kong, enquanto a DeepSeek passou a oferecer um rival ao Claude Fable 5 da Anthropic por um custo mais de 100 vezes menor.
Pontos-chave:
- O Qwen3.8-Max, da Alibaba, soma 2,4 trilhões de parâmetros e ativa cerca de 95 bilhões por consulta; os pesos abertos saem na próxima semana.
- As ações em Hong Kong fecharam em alta de 7%, enquanto os recibos negociados em Nova York subiram cerca de 4% no pré-mercado.
- O V4-Flash, da DeepSeek, custa perto de US$ 0,03 por teste de benchmark, ante US$ 3,15 do Claude Fable 5.
Lançamento do Qwen3.8-Max impulsiona ações da Alibaba
A gigante de Hangzhou lançou na segunda-feira o Qwen3.8-Max, descrito pela própria companhia como o sistema mais avançado de toda a família Qwen até agora. O modelo soma 2,4 trilhões de parâmetros — os ajustes internos que a IA aprende a partir dos dados — e ativa cerca de 95 bilhões a cada consulta. As ações da Alibaba em Hong Kong fecharam o dia em alta de 7%. Os recibos de ações (ADRs) negociados em Nova York avançaram cerca de 4% no pré-mercado.
O Qwen3.8-Max é multimodal, processando texto, imagens e vídeo, e aceita até 1 milhão de tokens por chamada. A Alibaba construiu o modelo sobre a arquitetura Qwen3.5, usando um desenho do tipo “mixture of experts”, em que apenas parte da rede é ativada em cada tarefa.
Segundo a empresa, o sistema levou 16 dias apenas para desenvolver uma ferramenta de linha de comando.
O Qwen3.8-Max é hoje a melhor colocação entre modelos chineses de texto no ranking da Arena.AI, embora ainda fique atrás do Claude Fable 5 e de três variantes Opus, da Anthropic. No ranking da plataforma para modelos capazes de interpretar imagens e outros insumos visuais, o sistema apareceu em segundo lugar no mundo. Os pesos abertos serão divulgados na semana que vem, a primeira liberação desse tipo para um modelo da classe Max da família Qwen. A Alibaba pretende publicá-los no Hugging Face e no ModelScope.
Veja também: Infraestrutura de IA, a aposta desesperada de US$ 1 bi de uma financeira para dominar data centers
DeepSeek V4-Flash aperta preços frente ao Claude Fable 5
A DeepSeek lançou o V4-Flash na sexta-feira, cobrando US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída. A consultoria Artificial Analysis estimou um custo médio de cerca de US$ 0,03 por teste de benchmark, contra US$ 0,86 do Kimi K3, da Moonshot AI, US$ 1,86 do GPT-5.6 Sol, da OpenAI, e US$ 3,15 do Claude Fable 5.
“As empresas chinesas de IA encontraram um mercado importante”, afirma Lian Jye Su, analista-chefe da consultoria Omdia, observando que muitos fluxos de trabalho corporativos precisam apenas de um sistema acessível e barato.
Guerra de preços em IA na China redefine economia dos modelos
A publicação de pesos abertos permite que desenvolvedores baixem as configurações internas de um modelo e o adaptem às próprias necessidades — estratégia que Anthropic, OpenAI e Google ainda não adotaram. O V4-Flash marcou 50 pontos em 100 no Artificial Analysis Intelligence Index, empate com o Gemini 3.6 Flash, do Google.
O Kimi K3 chegou a 57 pontos, enquanto os sistemas topo de linha de Anthropic e OpenAI ficaram cerca de nove pontos acima disso. O V4-Flash, apesar de mais barato, mostrou-se mais prolixo, gerando aproximadamente o dobro do volume mediano de tokens ao longo dos testes.
A DeepSeek ganhou atenção global no início de 2025, quando seus modelos R1 e V3 provocaram uma onda de vendas nas ações de tecnologia e colocaram em dúvida o ritmo de gastos dos EUA em IA. Depois, a companhia tornou permanente um corte de 75% nos preços, movimento que levou rivais como Moonshot, MiniMax, Z.AI, ByteDance e a própria Alibaba a seguir reduzindo tarifas desde então.
Na sequência: Rumores sobre iPhone dobrável ganham detalhes: US$ 2.500, sem Face ID, sem telefoto






