Zhipu AI presenta GLM-5.3-FlashX con mayor velocidad y eficiencia
Zhipu AI ha lanzado el modelo grande GLM-5.3-FlashX en su plataforma BigModel, y la API ahora está disponible. El modelo alcanza una velocidad máxima de salida de 200 tokens por segundo, destacando la inteligencia, la asequibilidad y la velocidad. Ofrece servicios de inferencia de alta capacidad y baja latencia para empresas y desarrolladores.
La versión anterior, GLM-5.3-Flash, anteriormente conocida como 'Ox Alpha' en el extranjero, fue elogiada por su fuerte rendimiento y rentabilidad. Para satisfacer la creciente demanda, Zhipu aprovechó una base de poder de cómputo de chips nacionales de 100.000 unidades e invirtió en la optimización de la inferencia, lo que llevó al lanzamiento de la versión mejorada FlashX.
FlashX mantiene la inteligencia y el precio del modelo original, al tiempo que maximiza la velocidad de generación, mejorando su atractivo comercial en escenarios de alta concurrencia. Los desarrolladores pueden acceder a él a través de la API oficial, mientras que los usuarios no técnicos pueden probarlo en el centro de experiencia. Esta actualización marca un progreso en la eficiencia y accesibilidad de la inferencia de modelos grandes a nivel nacional.