PrismML lanza bonsai 2 27b con un rendimiento del 98,2% utilizando un 1/9 del uso de memoria
El 18 de septiembre de 2026, PrismML anunció el lanzamiento de Bonsai 2 27B, un modelo que alcanza el 98,2% del rendimiento del modelo base Qwen3.8 27B, al tiempo que utiliza menos del 1/9 de la memoria. Esto sigue al lanzamiento anterior de Bonsai 27B a principios de 2026, que ya demostraba el 95% del rendimiento de Qwen3.6 27B con un menor uso de memoria.
La nueva versión, que incluye la cuantificación de tres valores, admite una ventana de contexto de 262K y funciona a 143 TPS en una NVIDIA GeForce RTX 5090 y 46,8 TPS en un Apple M5 Max. También cuenta con una eficiencia energética de 0,714 mWh por token, un 40% inferior a un modelo de 8B de precisión completa.
PrismML afirma que el modelo puede manejar tareas complejas como la programación, el análisis de documentos y la depuración multimodal localmente, utilizando llamadas a la API en la nube solo cuando sea necesario. El modelo está disponible bajo la licencia Apache 2.0, que admite tanto el hardware NVIDIA como Apple a través de CUDA y MLX, respectivamente.