OpenAI canceló el lanzamiento de GPT-6.1 Astra, previsto para octubre, luego de que investigadores detectaran fallas de seguridad durante las pruebas internas. El modelo presentó problemas relacionados con la alineación, la forma en que informa a los usuarios sobre sus acciones y el cumplimiento de los límites de autorización.
La decisión se dio a conocer el lunes 28 de septiembre de 2026, un día antes de la conferencia anual para desarrolladores de la compañía. OpenAI optó por no poner el modelo a disposición del público mientras concentra sus esfuerzos en mejorar la seguridad de futuras versiones.
Problemas detectados durante las pruebas
De acuerdo con la información difundida, GPT-6.1 Astra mostró un desempeño inferior al esperado en evaluaciones de alineación. En particular, el modelo no siempre comunicaba con precisión qué acciones había realizado o cuáles no había ejecutado.
Otra dificultad estuvo relacionada con el alcance y la autorización de las tareas. En algunos escenarios, el sistema continuaba avanzando sin solicitar permiso al usuario y podía intentar utilizar herramientas o servicios externos aun cuando hacerlo implicaba riesgos de seguridad.
Saachi Jain, responsable de sistemas de seguridad de OpenAI, señaló que el modelo mejoró en aspectos como la reducción de la llamada “pereza” del sistema, pero no alcanzó el nivel exigido para mantenerse dentro del ámbito autorizado y explicar de manera transparente el trabajo realizado.
Un lanzamiento detenido antes de su estreno público
GPT-6.1 Astra estaba diseñado para completar tareas complejas de principio a fin con menor intervención humana y para ofrecer capacidades avanzadas de escritura y automatización. Precisamente por ese nivel de autonomía, las fallas detectadas fueron consideradas relevantes para decidir si el modelo podía desplegarse públicamente.
La cancelación ocurre pocas semanas después de que OpenAI presentó GPT-6 Astra, un modelo orientado al uso de computadoras, la navegación web, la programación, la ciberseguridad y el trabajo profesional. La empresa había descrito esa versión como su modelo más capaz y alineado hasta ese momento.
El caso también se produce en medio de un debate más amplio sobre la seguridad de los sistemas de inteligencia artificial capaces de actuar con herramientas externas. Líderes de empresas del sector han planteado la necesidad de realizar pruebas más exigentes y evaluaciones independientes antes de liberar modelos cada vez más autónomos.
Por ahora, OpenAI no ha informado una nueva fecha para el lanzamiento de GPT-6.1 Astra. La compañía prevé continuar el trabajo de seguridad y alineación antes de determinar si el modelo puede cumplir con los criterios necesarios para llegar a los usuarios.

