Jogo revela que humanos têm dificuldade em identificar pedidos maliciosos de agentes de código de IA
Fonte: The Register06/08/2026, 13:44
Um jogo baseado em navegador concebido para testar a capacidade humana de validar pedidos de permissões de agentes de código de IA descobriu que os jogadores aprovaram aproximadamente um terço dos comandos perigosos em média. O desenvolvedor belga Alex Wauters criou o jogo após observar que a aprovação contínua de permissões leva a fadiga do programador e contornos inseguros. A análise de mais de 40.000 instâncias do jogo e 409.000 decisões totais de aprovação mostrou que violações de escopo—como agentes acedendo a configs Kubernetes ou ficheiros de credenciais AWS—foram perdidas 35% das vezes. Os comandos destrutivos como eliminações recursivas no directório raiz foram mais frequentemente detectados. O comando mais perdido foi npm run analyze, aprovado quase 65% das vezes apesar da capacidade de executar código arbitrário definido em ficheiros package.json. Os resultados sugerem que a supervisão humana-no-loop, embora necessária, pode ser insuficiente sem melhor design de interface e consciência de contexto do programador.