Los modelos de IA de china superan a los de ee. uu. en el uso semanal de tokens, manteniendo una ventaja de 21 semanas
Según los últimos datos de OpenRouter, el uso global de tokens de modelos de IA de gran tamaño, de 14 a 20 de septiembre, totalizó 129 billones, un aumento del 1,57% con respecto a la semana anterior. Los modelos chinos utilizaron 67,46 billones de tokens, un aumento semanal del 10,28%, mientras que los modelos estadounidenses utilizaron 14,21 billones de tokens, una disminución del 34,7%. Esto marca la vigésima primera semana consecutiva en que los modelos chinos han utilizado más tokens que los de EE. UU.
En las clasificaciones globales, cuatro de los cinco modelos principales eran chinos. DeepSeek V4.1-Flash lideró con 15,8 billones de tokens, un aumento semanal del 219%. El modelo, lanzado el 10 de septiembre, cuenta con capacidades mejoradas de codificación, agente y comprensión multimodal. Utiliza una arquitectura Causal-Encoder-Decoder, con una caché KV global reducida a aproximadamente 1/4 de la versión anterior. El coste para el acceso y el fallo de la caché de entrada, así como la salida por millón de tokens durante el tiempo de inactividad, son de 0,02 yuanes, 1 yuan y 4 yuanes, lo que representa una reducción del 60%, 33,3% y 11,1% en comparación con la generación anterior.
Las pruebas de Análisis Artificial encontraron que V4.1-Flash utiliza aproximadamente 89.000 tokens de salida por tarea, más que los 62.000 tokens de V4Flash0731, y se considera relativamente verboso en la salida. Zhipu GLM5.3Flash se clasificó en segundo lugar con 14,1 billones de tokens, seguido por Tencent HuanYuan Hy4preview en tercer lugar con 12,5 billones de tokens, y DeepSeek-V4-Flash-0731 en quinto lugar con 9,44 billones de tokens.