Ant Group abre código de modelo Ling-3.0-tiny optimizado para inferencia local
Ant Baili, la división de IA de Ant Group, lanzó la versión de código abierto del modelo Ling-3.0-tiny, un modelo de arquitectura MoE (Mixture of Experts) ligero con 7,9 mil millones de parámetros totales, activando 1,3 mil millones por token. El modelo fue diseñado específicamente para inferencia de bajo costo y fue probado en plataformas como NVIDIA DGX Spark y computadoras Apple Silicon, logrando velocidades de inferencia de aproximadamente 86-90 tokens por segundo en una MacBook Pro M4. El modelo está disponible en múltiples formatos de peso (BF16, FP8 e INT4) para satisfacer diferentes requisitos de implementación.