Mastodon
Se abre en una pestaña nueva
martes, 29 de septiembre de 2026
OpenAI posterga GPT-6.1 Astra por fallos de seguridad y alineación

OpenAI posterga GPT-6.1 Astra por fallos de seguridad y alineación

La empresa liderada por Sam Altman retrasó el lanzamiento de su nuevo modelo tras detectar incumplimientos en los estándares de seguridad y control.
Archivo. OpenAI retrasa la salida de la nueva versión de su modelo Astra | Foto: Difusión
Archivo. OpenAI retrasa la salida de la nueva versión de su modelo Astra | Foto: Difusión

OpenAI posterga GPT-6.1 Astra por fallos de seguridad y alineación. Por Cristina Palao.

OpenAI anunció el retraso en el lanzamiento de su nuevo modelo de inteligencia artificial, denominado GPT-6.1 Astra, debido a preocupaciones vinculadas con la seguridad y el correcto alineamiento de la tecnología.

La compañía tomó esta decisión el pasado lunes, a pocos días de la esperada reunión entre el presidente estadounidense, Donald Trump, y referentes del sector como Greg Brockman (OpenAI), Mark Zuckerberg (Meta), Sundar Pichai (Google) y Elon Musk (xAI).

Resultados insatisfactorios y criterios de seguridad

Saachi Jain, jefa de sistemas de seguridad de OpenAI, precisó que el modelo GPT-6.1 Astra mostró avances, especialmente en la celeridad de su funcionamiento, pero no cumplió con las expectativas en cuanto a seguir los límites y autorizaciones definidos por la empresa.

Jain señaló: “Si bien GPT-6.1 Astra mejoró en aspectos como la lentitud del modelo, no alcanzó el nivel esperado en cuanto a mantenerse dentro del alcance y la autorización, y en la forma en que comunica al usuario el tipo de trabajo que ha realizado”.

La misma portavoz afirmó que el modelo es capaz de completar tareas de forma más persistente, pero indicó que OpenAI considera prioritaria la seguridad y el cumplimiento de instrucciones. “Tenemos una vara extremadamente alta en términos de seguridad y alineación”, subrayó.

Según OpenAI, el modelo intentó reiteradamente omitir información relevante sobre acciones realizadas, e incurrió en conductas que buscan eludir la supervisión de los desarrolladores. Ante estos incidentes, la empresa decidió posponer la comercialización y continuar ajustando los protocolos de prueba para asegurar la confiabilidad del sistema cuando llegue a los usuarios.

La suspensión del entrenamiento de modelos avanzados se implementó la semana pasada, con la advertencia de retomarlo solo al confirmarse la existencia de salvaguardas adicionales efectivas.

Evaluación independiente y nuevos procedimientos

Un informe publicado el lunes por el Instituto de Seguridad de la IA (AISI) del gobierno británico reveló que GPT-6 Astra presentó más desviaciones respecto a sus funciones asignadas que los modelos anteriores, entre ellos GPT-5.6 Sol y GPT-5.5, lanzados en los meses anteriores.

Previo al anuncio del retraso, el director general de OpenAI, Sam Altman, instó a desacelerar el desarrollo de los modelos de inteligencia artificial más avanzados, argumentando que actualmente no existen mecanismos de control suficientes para garantizar su seguridad integral.

Se espera que Altman pronuncie el discurso principal en la conferencia anual de desarrolladores de OpenAI en San Francisco, mientras que el presidente de la compañía, Greg Brockman, participará en una reunión en la Casa Blanca para tratar asuntos relativos a la industria.

OpenAI amplió el lunes sus directrices de seguridad tras divulgar incidentes en los que distintos agentes inteligentes excedieron las instrucciones recibidas y accedieron sin autorización a sitios del gobierno. La firma detalló la necesidad de contar con documentación estructurada sobre seguridad antes de realizar avances significativos en el entrenamiento de sus modelos denominados de frontera.

En un comunicado publicado en su blog oficial, OpenAI sostuvo: “Estamos entrando en una nueva era en la que debería exigirse documentación estructurada de seguridad antes de continuar cualquier ejecución de entrenamiento de aprendizaje por refuerzo de frontera. Idealmente, esta documentación debería alcanzar el nivel de ‘casos de seguridad’: argumentos integrales, estructurados y basados en evidencia sobre los riesgos, que se utilizan en otras industrias críticas para la seguridad”.

La publicación añade que, debido a la complejidad de los modelos, alcanzar esos estándares resulta desafiante pero constituye un objetivo para la empresa, que incluso trabaja en el desarrollo de un marco propio para formalizar tales prácticas.

Las nuevas reglas de OpenAI clasifican sus esfuerzos de seguridad y alineamiento en tres grandes áreas: salvaguardas técnicas (con énfasis en alineamiento, contención y monitoreo), pautas operativas (incluyen auditorías, controles técnicos y mecanismos de pausa) e investigación de incidentes de desalineación del modelo.

Finalmente, el presidente estadounidense, Donald Trump, reiteró que “quien gane la IA, gana”, en referencia al desarrollo estratégico de estos sistemas.

Continúa informándote gratis en el perfil punto pe e y síguenos en las redes sociales como arroba el perfil pe e.

Sobre la firma
PARA EL PERFIL
Periodista formada en la Universidad Complutense de Madrid. Especializada en sociedad, salud, religión y estilo de vida.