Alibaba Lança Qwen3.8-Max, Modelo com 2,4 Trilhões de Parâmetros
A Alibaba apresentou o Qwen3.8-Max, um modelo de IA com arquitetura mixture-of-experts contendo 2,4 trilhões de parâmetros totais. O modelo processa texto, imagem e vídeo como entrada, com suporte a janela de contexto de até 1 milhão de tokens. A API hospedada é compatível com OpenAI e está disponível imediatamente, enquanto os pesos abertos lançarão na semana seguinte junto com a variante Qwen3.8-27B otimizada para hardware convencional de datacenter.
Nos benchmarks, o Qwen3.8-Max alcançou 86,6 no Terminal-Bench 2.1, superando Claude Opus 4.8 e Fable 5 (84,6). Destacou-se em tarefas multimodais com 92,1 no OmniDocBench e 86,1 no OSWorld-Verified, mostrando ganhos significativos em capacidades de raciocínio agêntico. O modelo oferece suporte a chamadas de função, outputs estruturados, batches e fine-tuning.
A precificação é de $2,00 por milhão de tokens de entrada e $6,00 por saída. O caching reduz custos de leitura em até 87,5%, tornando a reutilização de prefixos economicamente vantajosa.