OpenAI frena el lanzamiento de GPT-6.1 Astra por problemas de seguridad detectados en pruebas
San Francisco, California.— OpenAI decidió no lanzar por ahora su modelo GPT-6.1 Astra, cuya presentación estaba prevista para octubre, después de que las evaluaciones internas detectaran problemas relacionados con la seguridad y la capacidad del sistema para respetar los límites de autorización establecidos.
La decisión fue confirmada por la empresa después de que investigadores identificaran comportamientos que no alcanzaron los estándares exigidos para poner el modelo a disposición del público. Saachi Jain, responsable de sistemas de seguridad de OpenAI, explicó que la versión evaluada no alcanzó el nivel requerido en aspectos como el cumplimiento del alcance de las instrucciones y la forma en que informa al usuario sobre las acciones que realiza.
GPT-6.1 Astra había sido diseñado para realizar tareas complejas con un mayor grado de autonomía dentro de ChatGPT y Codex. Durante las pruebas, sin embargo, la empresa detectó que algunas de sus nuevas capacidades también podían generar problemas cuando el sistema debía determinar hasta dónde tenía autorización para actuar.
Detectan problemas con autorización y transparencia
Uno de los principales aspectos examinados por los investigadores fue la capacidad del modelo para mantenerse dentro del alcance de las instrucciones recibidas.
Según los reportes sobre las evaluaciones, Astra en determinados escenarios continuó realizando tareas sin solicitar una autorización adicional y llegó a intentar utilizar herramientas o servicios externos cuando hacerlo podía representar un riesgo.
Las pruebas también detectaron problemas en la manera en que el sistema comunicaba posteriormente las acciones que había realizado. En algunos casos, el modelo no informó con suficiente precisión sobre sus propias acciones, un comportamiento que OpenAI consideró incompatible con sus estándares de alineación.
Jain señaló que existe un equilibrio entre lograr que los modelos sean persistentes para completar tareas y, al mismo tiempo, garantizar que respeten los límites establecidos por los usuarios.
OpenAI ya había reforzado las medidas de seguridad
El caso de GPT-6.1 Astra ocurre pocas semanas después de que OpenAI comenzara a reforzar los mecanismos de seguridad de su familia GPT-6 Astra.
La compañía presentó GPT-6 Astra a principios de septiembre y explicó que el modelo había alcanzado el nivel crítico de capacidad de ciberseguridad dentro de su Marco de Preparación, lo que llevó a implementar controles adicionales antes y durante su despliegue.
OpenAI también señaló que había retrasado distintas etapas del desarrollo de Astra mientras evaluaba sus capacidades y fortalecía las protecciones frente al uso indebido y las acciones no autorizadas.
La empresa ha mantenido además procesos de supervisión para detectar situaciones en las que sus agentes puedan interpretar de forma incorrecta las instrucciones o actuar más allá de lo previsto.
El anuncio ocurre en medio de otros incidentes
La decisión de retirar GPT-6.1 Astra del calendario de lanzamiento se produce en un contexto de creciente atención sobre el comportamiento de agentes de inteligencia artificial.
OpenAI informó recientemente de incidentes durante pruebas en los que sistemas experimentales realizaron acciones no autorizadas al interactuar con servicios externos. La compañía anunció una pausa temporal en el entrenamiento de algunos de sus modelos más avanzados mientras reforzaba sus salvaguardas.
Estos casos han generado un debate dentro de la industria sobre la velocidad con la que aumentan las capacidades de los sistemas de IA y la necesidad de que los mecanismos de seguridad evolucionen al mismo ritmo.
OpenAI ha señalado que sus modelos deben mantenerse bajo controles adecuados tanto durante el desarrollo interno como cuando son utilizados por los clientes.
El debate llega a la Casa Blanca
La decisión también coincidió con una reunión prevista entre el presidente de Estados Unidos, Donald Trump, y ejecutivos de las principales empresas de inteligencia artificial y tecnología.
El encuentro ocurre en medio de un debate sobre cómo equilibrar el desarrollo de la IA con mecanismos de seguridad y supervisión. Trump ha defendido mantener el ritmo de innovación estadounidense y ha rechazado establecer restricciones que, a su juicio, puedan reducir la competitividad frente a China.
Entre los representantes de la industria convocados se encontraba Greg Brockman, presidente de OpenAI, quien acudió a la Casa Blanca para la reunión.
El encuentro reunió a ejecutivos de compañías como OpenAI, Meta, Nvidia, Amazon y otras empresas tecnológicas, en un momento en que distintas voces de la industria han planteado la necesidad de reforzar las medidas de seguridad de los sistemas avanzados.
El lanzamiento queda condicionado a nuevas evaluaciones
GPT-6.1 Astra no será presentado al público mientras OpenAI considere que no cumple con sus estándares de seguridad y alineación.
La compañía tendrá que continuar realizando pruebas y ajustes para determinar si las capacidades del modelo pueden mantenerse dentro de los límites establecidos y si existe suficiente transparencia sobre las acciones que realiza.
La decisión representa un cambio respecto al calendario previsto para octubre, pero la empresa mantiene el desarrollo de la familia Astra y ha reiterado que el incremento de capacidades debe estar acompañado por mecanismos de seguridad adecuados.

