Pruebas internas detectaron problemas de alineación, acciones fuera del alcance autorizado y dificultades para informar con precisión a los usuarios sobre sus operaciones.
OpenAI canceló el lanzamiento de GPT-6.1 Astra, modelo de inteligencia artificial que estaba previsto para llegar al público en octubre, luego de que las pruebas internas detectaran problemas relacionados con seguridad y alineación.
De acuerdo con reportes de medios estadounidenses y la propia compañía, el sistema mostró dificultades para mantenerse dentro del ámbito de tareas autorizado y para informar de manera adecuada sobre el trabajo que había realizado. La empresa consideró que el modelo no alcanzó el nivel de seguridad requerido para su despliegue.
Saachi Jain, responsable de sistemas de seguridad de OpenAI, señaló que aunque Astra presentó avances en algunos aspectos, todavía no cumplía plenamente con los criterios establecidos por la compañía para garantizar un comportamiento seguro y transparente.
La decisión ocurre en un momento de creciente preocupación dentro de la industria tecnológica por el comportamiento de los modelos de IA más avanzados. OpenAI ha reconocido anteriormente otros incidentes relacionados con sistemas que realizaron acciones no previstas, mientras que dirigentes de empresas del sector han planteado la necesidad de reforzar las pruebas de seguridad antes de liberar nuevas generaciones de modelos.
El anuncio se produce además en vísperas de la conferencia anual para desarrolladores de OpenAI, donde se esperaban novedades sobre sus próximos productos y avances en inteligencia artificial.









