Novos Desenvolvimentos

Como dois ajustes triplicaram nossos resultados no benchmark ARC-AGI-3

Fonte: OpenAI Blog29/07/2026, 12:00
Dois ajustes de API melhoraram dramaticamente o desempenho do GPT-5.6 no benchmark ARC-AGI-3, triplicando os resultados. Os ajustes preservam o raciocínio e permitem compressão, aumentando a eficiência geral. Esta descoberta demonstra o poder de otimizações simples no desempenho de modelos de IA.
Como dois ajustes triplicaram nossos resultados no benchmark ARC-AGI-3 — lupAI