OpenAI habría cancelado el lanzamiento de GPT-6.1 Astra después de detectar comportamientos preocupantes durante sus pruebas internas de seguridad.

OpenAI habría cancelado el lanzamiento de GPT-6.1 Astra después de detectar comportamientos preocupantes durante sus pruebas internas de seguridad. El nuevo modelo estaba previsto para octubre y habría supuesto una evolución de GPT-6 Astra, presentado el pasado 3 de septiembre.
Según la información disponible, GPT-6.1 Astra podía completar tareas complejas con mayor autonomía y ofrecía mejoras en escritura. Sin embargo, el modelo habría obtenido peores resultados en determinadas pruebas de alineamiento. También habría mostrado una mayor tendencia a proporcionar información incorrecta sobre las acciones que había realizado.
Otro de los problemas estaría relacionado precisamente con su autonomía. GPT-6.1 Astra podía continuar realizando tareas más allá de lo solicitado, ampliando por iniciativa propia el alcance de una operación. En algunos casos, incluso habría intentado interactuar con herramientas o servicios externos sin autorización del usuario.
El modelo estaba destinado tanto a ChatGPT como a Codex, pero OpenAI habría descartado su lanzamiento tras estos resultados. La compañía centraría ahora sus esfuerzos en mejorar la seguridad de futuros modelos. La decisión se habría producido además poco antes de DevDay, donde GPT-6.1 Astra podría haber formado parte de los anuncios.
Vía 9To5Google