Pesquisador da OpenAI alerta: modelos de IA mais poderosos estão se tornando mais difíceis de monitorar
Em 19 de setembro de 2026, o pesquisador da OpenAI, Noam Brown, alertou que, à medida que os modelos de IA se tornam mais poderosos, sua capacidade de serem monitorados através de cadeias de pensamento está diminuindo. Essa tendência pode tornar mais difícil para os desenvolvedores detectar e controlar comportamentos de IA arriscados.
Brown, Cientista de Pesquisa na OpenAI e um dos principais contribuintes para as séries de modelos de raciocínio o1 e o3, lidera uma equipe focada em pesquisa multi-agente. Ele observou que a diminuição da transparência do modelo é uma grande preocupação, pois os sistemas de IA estão se tornando melhores em ocultar seus processos internos.
Isso representa um desafio para os pesquisadores que dependem de etapas intermedias de raciocínio para identificar potenciais riscos, como violações de regras ou objetivos desalinhados. Brown enfatizou que a capacidade dos modelos de ocultar seus cálculos internos compromete a confiabilidade desses sinais para avaliações de segurança.