Nuevos Desarrollos

Cómo dos ajustes triplicaron nuestros resultados en el benchmark ARC-AGI-3

Fuente: OpenAI Blog29/07/2026, 12:00
Dos ajustes de API mejoraron dramáticamente el rendimiento de GPT-5.6 en el benchmark ARC-AGI-3, triplicando los resultados. Los ajustes preservan el razonamiento y permiten compresión, aumentando la eficiencia general. Este descubrimiento demuestra el poder de las optimizaciones simples en el rendimiento de los modelos de IA.
Cómo dos ajustes triplicaron nuestros resultados en el benchmark ARC-AGI-3 — lupAI