Copilot do Word vulnerável a ataques de injeção de instruções auto-replicáveis
Um investigador descreveu uma nova classe de ataques contra o Copilot do Microsoft Word baseada em injeção de instruções ocultas. A vulnerabilidade permite que comandos discretos inseridos num documento sejam interpretados pela ferramenta de IA e copiados automaticamente para novos documentos, criando um ciclo de auto-replicação.
O ataque funciona quando um documento contendo instruções ocultas é utilizado como material base para uma sessão do Copilot. A assistência interpreta estas ordens como parte da solicitação legítima do utilizador e as incorpora no conteúdo gerado. Se esse documento resultante for processado novamente pelo Copilot, o ciclo repete-se, espalhando o ataque mesmo sem a presença do ficheiro original.
A descoberta foi divulgada responsavelmente à Microsoft, que recebeu 144 dias para corrigir o problema. Até ao momento, não existe uma mitigação que cubra completamente esta classe de ataques.