Seguridad y Ética

Parches de IA Insuficientes: Más de la Mitad de las Correcciones Generadas Fallan

1Password + Anthropic + OpenAI + VeracodeFuente: CyberScoop07/08/2026, 14:10
Nueva investigación que examina la capacidad de la IA para corregir vulnerabilidades de seguridad ha expuesto limitaciones significativas en los modelos actuales, generando preocupaciones sobre depender de IA generativa para trabajos críticos de ciberseguridad. Investigadores de 1Password probaron ChatGPT 5.5 de OpenAI y Claude Opus 4.8 de Anthropic contra seis vulnerabilidades comunes de alta complejidad, descubriendo que ambos modelos lograron una tasa de éxito inferior al 50% al resolver completamente vulnerabilidades sin introducir nuevos problemas. Un estudio paralelo de Veracode en 100 modelos encontró problemas similares, con aproximadamente el 44% de las pruebas resultando en modelos introduciendo inadvertidamente vulnerabilidades explotables del OWASP Top 10. Mientras que modelos más avanzados como Mythos de Anthropic y GPT-5.6-Sol de OpenAI supuestamente muestran capacidades mejoradas de ciberseguridad y se están distribuyendo a través de las iniciativas Project Glasswing y Daybreak, estos aún no han sido probados independientemente, dejando preguntas sobre su efectividad práctica para parching autónomo a gran escala.
Parches de IA Insuficientes: Más de la Mitad de las Correcciones Generadas Fallan — lupAI