AAI publica pesquisa sobre desenvolvimento de IA com raciocínio de nível de especialista
A organização AAI divulgou dois artigos científicos que exploram novos caminhos para construir inteligência artificial com capacidades de raciocínio avançado em áreas STEM. O primeiro paper argumenta que os métodos de treino atuais dos modelos de linguagem são insuficientes e propõe "the diligent learner", uma técnica que constrói árvores de raciocínio profundas, atingindo nível de especialista.
O segundo artigo questiona o desempenho real de modelos de ponta como O3-pro, Gemini 2.5 pro e Grok 4 heavy. Apesar das pontuações altas em benchmarks, os investigadores revelam que estes modelos falham drasticamente em problemas de Programação Dinâmica, alcançando desempenho praticamente nulo mesmo com exemplos de suporte.
Os investigadores disponibilizarão um dataset com 120 problemas complexos para validação comunitária das suas conclusões.