Análises & Opinião

Agentes de IA conseguem agora realizar trabalho economicamente relevante

Anthropic + OpenAIFonte: Ethan Mollick - One Useful Thing29/09/2025, 15:52
A OpenAI divulgou um novo teste que mede as capacidades de IA em comparação com especialistas humanos, utilizando tarefas realistas que levam entre quatro e sete horas para experts completarem. Os resultados indicam que os modelos de IA aproximam-se muito do desempenho humano, embora com variações conforme o setor. Contrariamente ao esperado, o principal fator de deficiência não foi alucinações ou erros, mas a incapacidade de formatar resultados corretamente ou seguir instruções precisas — áreas em que a IA está a melhorar rapidamente. Embora a capacidade de executar tarefas individuais não implique substituição imediata de empregos — já que estes envolvem múltiplas funções — há aplicações de enorme valor onde a IA já é efetiva. A replicação de pesquisa científica ilustra bem este ponto: um processo que normalmente consome muitas horas de trabalho pode ser agora automatizado. Modelos como Claude Sonnet 4.5 demostraram capacidade de analisar papers complexos, converter código estatístico e reproduzir resultados de forma autónoma. Os agentes de IA melhoraram dramaticamente na sua independência. Pequenos aumentos na precisão dos modelos resultam em ganhos exponenciais nas tarefas que conseguem completar. Os modelos mais recentes são auto-corretivos, permitindo corrigir erros sem falha completa. Existe porém um risco significativo: usar IA irrefletidamente para gerar conteúdo desnecessário. A solução passa por especialistas trabalharem deliberadamente com estes agentes — delegando tarefas como primeira tentativa e revendo resultados. Investigação sugere que este fluxo pode melhorar produtividade em 40% enquanto reduz custos em 60%, mantendo especialistas no controlo.
Agentes de IA conseguem agora realizar trabalho economicamente relevante — lupAI