Auditoria de segurança revela vulnerabilidades críticas no ecossistema de agentes de IA
Uma auditoria de segurança abrangente do ecossistema Agent Skills, que inclui ferramentas da Anthropic e Vercel, encontrou que 36 porcento de todas as skills continham pelo menos uma questão de segurança de nível crítico, incluindo distribuição de malware, ataques de injeção de prompt e exposição de secrets. Pesquisadores do Mozilla demonstraram com sucesso ataques de injeção de prompt indirecta contra Claude, uma técnica que embute instruções maliciosas em conteúdo externo processado pelo agente, resultando em execução de reverse shell em sistemas de desenvolvedores. Defender contra injeção de prompt requer múltiplas camadas de proteção incluindo monitorização de anomalias comportamentais e preparação para contenção de agentes e remediação. Equipas de segurança devem reconhecer que ataques bem-sucedidos em agentes de IA podem levar a perda de dados catastrófica ou ações não autorizadas de sistema, pois agentes frequentemente acessam dados mais sensíveis do que funcionários humanos.