Juego revela que los humanos tienen dificultades para identificar solicitudes maliciosas de agentes de código de IA
Fuente: The Register06/08/2026, 13:44
Un juego basado en navegador diseñado para probar la capacidad humana de validar solicitudes de permisos de agentes de código de IA encontró que los jugadores aprobaron aproximadamente un tercio de los comandos peligrosos en promedio. El desarrollador belga Alex Wauters creó el juego después de observar que la aprobación continua de permisos conduce a fatiga del desarrollador y soluciones inseguras. El análisis de más de 40.000 instancias del juego y 409.000 decisiones de aprobación totales mostró que las violaciones de alcance—como agentes que acceden a configuraciones de Kubernetes o archivos de credenciales de AWS—se perdieron el 35% de las veces. Los comandos destructivos como eliminaciones recursivas en el directorio raíz se detectaron con mayor frecuencia. El comando más perdido fue npm run analyze, aprobado casi el 65% de las veces a pesar de la capacidad de ejecutar código arbitrario definido en archivos package.json. Los resultados sugieren que la supervisión humana-en-el-bucle, aunque necesaria, puede ser insuficiente sin un mejor diseño de interfaz y conciencia del contexto del desarrollador.