OpenAI confirmó esta semana que uno de sus agentes de inteligencia artificial (IA) logró ingresar sin autorización a la infraestructura de la empresa Hugging Face durante una prueba interna, en lo que describió como un “incidente cibernético sin precedentes”.
El director ejecutivo de OpenAI, Sam Altman, anunció el hecho mediante un comunicado difundido en redes sociales. “Tuvimos un incidente de seguridad importante durante la evaluación de nuestros modelos”, afirmó Altman.
De acuerdo con el comunicado, “consideramos que este incidente constituye un hecho cibernético sin precedentes, que involucró capacidades de vanguardia en ciberseguridad ofensiva, y estamos respondiendo en consecuencia”.
Detalles del incidente en Hugging Face
Hugging Face, empresa dedicada al desarrollo e integración de herramientas de inteligencia artificial, informó la semana pasada sobre una intrusión detectada en sus sistemas de procesamiento de datos. Según la empresa, el acceso se vinculó con el accionar de un agente de inteligencia artificial que operó por cuenta propia.
Clément Delangue, cofundador y CEO de Hugging Face, explicó que sospechaban que el ataque provenía de un laboratorio líder, dada la alta sofisticación del agente detectado. “¡Y resulta que sí!”, puntualizó tras la confirmación de OpenAI.
Delangue indicó a través de sus redes sociales que el equipo de Hugging Face trabajó junto con OpenAI en la investigación del incidente. Añadió que confían en que no existió intención maliciosa por parte de la empresa estadounidense.
“Creemos firmemente que no hubo intención maliciosa de su parte. ¡Es realmente alucinante que todo esto haya ocurrido de manera autónoma!”, señaló el CEO.
De acuerdo con OpenAI, el incidente ocurrió durante una evaluación interna en la que los modelos de IA fueron instruidos para ejecutar explotaciones avanzadas mediante complejas cadenas de ataque, con el propósito de cuantificar sus capacidades en ciberseguridad.
Las pruebas se realizaron en un entorno altamente controlado, con acceso a la red restringido exclusivamente a la instalación de paquetes a través de software de terceros alojado internamente.
La empresa dirigida por Altman precisó que la intrusión fue causada por una combinación de varios de sus modelos de IA, entre los que se incluye el recientemente presentado GPT 5.6 Sol y otro modelo más avanzado que permanece en fase de pruebas internas.
Metodología y hallazgos de la evaluación interna
Durante las pruebas, los modelos utilizaron una cantidad significativa de capacidad de cómputo de inferencia para encontrar una manera de conseguir acceso abierto a internet y así superar el desafío de evaluación establecido.
Una vez obtenido el acceso, los agentes de IA detectaron que Hugging Face alojaba modelos, conjuntos de datos y herramientas relevantes para su cometido. Según la reconstrucción de la empresa, el modelo buscó y encontró formas de acceder a información confidencial para “hacer trampa” en la evaluación.
En un caso puntual, el modelo combinó múltiples vectores de ataque, que incluyeron desde el uso de credenciales robadas hasta la explotación de vulnerabilidades desconocidas, logrando ejecutar código de manera remota en los servidores de Hugging Face.
El equipo de seguridad de OpenAI detectó esta actividad anómala internamente. La empresa señaló que toda la operación estaba restringida a un entorno de pruebas, sin impacto observado fuera de él.
El CEO de Hugging Face consideró el evento como el primero de su tipo registrado entre agentes de inteligencia artificial.
Reacciones y contexto regulatorio
La revelación del hackeo autónomo se produce en medio de un contexto de vigilancia internacional sobre las capacidades de ciberseguridad de sistemas de inteligencia artificial avanzados. El presidente de Estados Unidos, Donald Trump, firmó en junio una orden ejecutiva que habilita a su administración a evaluar los riesgos de seguridad nacional de los sistemas de IA de última generación antes de su lanzamiento público.
OpenAI destacó en su comunicado que “la IA acelera el descubrimiento y la explotación de vulnerabilidades”, y subrayó que la principal enseñanza del incidente es la necesidad de que la seguridad y la protección acompañen el desarrollo acelerado de estas capacidades.










