Modelos de IA da china ultrapassam os EUA no uso semanal de tokens, mantendo vantagem de 21 semanas
De acordo com os dados mais recentes da OpenRouter, o uso global de tokens de modelos de IA de grande escala de setembro de 14 a 20 totalizou 129 trilhões, um aumento de 1,57% em relação à semana anterior. Os modelos chineses contabilizaram 67,46 trilhões de tokens, um aumento semanal de 10,28%, enquanto os modelos dos EUA utilizaram 14,21 trilhões de tokens, uma queda de 34,7%. Isto marca a 21ª semana consecutiva em que os modelos chineses ultrapassaram os modelos dos EUA em termos de uso de tokens.
Nos rankings globais, quatro dos cinco modelos principais eram chineses. O DeepSeek V4.1-Flash liderou com 15,8 trilhões de tokens, um aumento semanal de 219%. O modelo, lançado em 10 de setembro, apresenta capacidades aprimoradas de codificação, agente e compreensão multimodal. Utiliza uma arquitetura Causal-Encoder-Decoder, com um cache KV global reduzido a cerca de 1/4 da versão anterior. O custo para o acesso e a falta de acesso ao cache de entrada e a saída por milhão de tokens durante o tempo ocioso são de 0,02 yuans, 1 yuan e 4 yuans, representando 60%, 33,3% e 11,1% de redução em relação à geração anterior.
Testes de Análise Artificial revelaram que o V4.1-Flash utiliza aproximadamente 89.000 tokens de saída por tarefa, superior aos 62.000 tokens do V4Flash0731, e é considerado relativamente verboso na saída. O Zhipu GLM5.3Flash ficou em segundo lugar com 14,1 trilhões de tokens, seguido pelo Tencent HuanYuan Hy4preview em terceiro lugar com 12,5 trilhões de tokens, e o DeepSeek-V4-Flash-0731 em quinto lugar com 9,44 trilhões de tokens.