AAI publica investigación sobre entrenar IA con razonamiento de nivel experto
La organización AAI lanzó dos artículos científicos que avanzan en el desarrollo de inteligencia artificial con razonamiento especializado en campos STEM. El primer trabajo critica las técnicas de entrenamiento actuales de modelos de lenguaje e introduce "the diligent learner", un método novel diseñado para construir búsquedas profundas de razonamiento que igualen la pericia humana.
El segundo artículo cuestiona las afirmaciones sobre modelos líderes incluyendo O3-pro, Gemini 2.5 pro y Grok 4 heavy. A pesar del éxito en benchmarks, los investigadores demuestran que estos sistemas tienen desempeño casi nulo al resolver problemas complejos de Programación Dinámica, incluso con ejemplos extensivos.
El equipo planea liberar un conjunto de datos de referencia con problemas algorítmicos desafiantes para permitir la validación más amplia de sus hallazgos.