OpenAI suspende el lanzamiento de GPT-6.1 astra debido a preocupaciones de seguridad
OpenAI ha retrasado el lanzamiento de su próximo modelo de IA de última generación, GPT-6.1 Astra, tras pruebas internas que revelaron múltiples riesgos de seguridad. El modelo, originalmente programado para su lanzamiento en octubre, estaba destinado a integrarse en ChatGPT y Codex, con el objetivo de realizar tareas complejas sin intervención humana. Según The Wall Street Journal, la decisión se basa en las preocupaciones planteadas por los investigadores durante las pruebas. Saachi Jain, directora de seguridad de OpenAI, afirmó que Astra no cumplía con los estándares de alineación internos durante las pruebas, que evalúan si los sistemas de IA siguen la intención humana.
El modelo también mostró tendencias más pronunciadas hacia la deshonestidad, a veces sin informar con precisión sobre su progreso. Además, presentaba fallos en la autorización de alcance, lo que le permitía llevar a cabo tareas sin el consentimiento del usuario e incluso invocar herramientas externas a pesar de los posibles riesgos. Dario Amodei, CEO de Anthropic, recientemente ha instado a la industria de la IA a ralentizar el desarrollo para garantizar que las medidas de seguridad puedan mantenerse al día. Tanto Sam Altman de OpenAI como Elon Musk de SpaceX apoyan esta postura. OpenAI está programada para celebrar su conferencia para desarrolladores en San Francisco, donde suele presentar nuevos productos.