PrismML lança o bonsai 2 27b com 98,2% de desempenho em 1/9 do uso de memória
Em 18 de setembro de 2026, a PrismML anunciou o lançamento do Bonsai 2 27B, um modelo que alcança 98,2% do desempenho do modelo base Qwen3.8 27B, utilizando menos de 1/9 da memória. Isso segue o lançamento anterior do Bonsai 27B, no início de 2026, que já demonstrava 95% do desempenho do Qwen3.6 27B com menor uso de memória.
A nova versão, com quantização de três valores, suporta uma janela de contexto de 262K e opera a 143 TPS em um NVIDIA GeForce RTX 5090 e 46,8 TPS em um Apple M5 Max. Também possui uma eficiência energética de 0,714 mWh por token, 40% menor do que um modelo de 8B de precisão total.
A PrismML afirma que o modelo pode lidar com tarefas complexas como programação, análise de documentos e depuração multimodal localmente, com chamadas de API na nuvem apenas quando necessário. O modelo está disponível sob a licença Apache 2.0, suportando tanto hardware NVIDIA quanto Apple através de CUDA e MLX, respectivamente.