OpenAI informó que uno de sus sistemas de inteligencia artificial logró hackear de forma autónoma a otra empresa del sector durante una evaluación interna, un hecho que la compañía calificó como un “incidente cibernético sin precedente”.
El director ejecutivo de OpenAI, Sam Altman, dio a conocer el caso mediante un comunicado publicado en redes sociales.
"Tuvimos un incidente de seguridad importante durante la evaluación de nuestros modelos", señaló.
We're partnering with @huggingface to investigate an unprecedented security incident.
— OpenAI (@OpenAI) July 21, 2026
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.
Sharing preliminary findings to help defenders understand emerging risks:…
Hugging Face detectó la intrusión
La empresa Hugging Face informó la semana pasada que había identificado una intrusión en sus sistemas de procesamiento de datos y sospechaba que había sido provocada por un agente de inteligencia artificial que actuó de manera autónoma.
Su director ejecutivo y cofundador, Clément Delangue, explicó que la sofisticación del ataque hacía pensar que provenía de uno de los principales laboratorios de desarrollo de IA.
"Dada la sofisticación del agente, sospechamos que el ciberataque de la semana pasada podría haber provenido de un laboratorio de frontera. ¡Y resulta que sí!", afirmó.
La IA encontró una vulnerabilidad y usó credenciales robadas
De acuerdo con OpenAI, la intrusión fue resultado de la combinación de varios de sus modelos de inteligencia artificial, entre ellos el recién presentado GPT-5.6 Sol y otro sistema más avanzado que aún permanece en fase de pruebas internas.
La empresa explicó que el agente de IA utilizó credenciales robadas y descubrió una vulnerabilidad previamente desconocida para acceder a los servidores de Hugging Face.
Además, señaló que el sistema llegó a “extremos para alcanzar un objetivo de prueba bastante limitado” y encontró formas de obtener información confidencial que podía utilizar para alterar los resultados de la evaluación.
OpenAI descarta intención maliciosa
Tras el incidente, Clément Delangue aseguró que trabajó durante las últimas 24 horas con OpenAI para analizar lo ocurrido y descartó que existiera una intención deliberada por parte de la empresa.
"Creemos firmemente que no hubo intención maliciosa de su parte. ¡Es realmente alucinante que todo esto haya ocurrido de manera autónoma!", expresó.
El directivo agregó que este podría tratarse del primer incidente de este tipo registrado entre sistemas de inteligencia artificial.
Crecen las preocupaciones por la seguridad de la IA
El caso ocurre en un contexto de creciente preocupación por las capacidades de ciberseguridad de los modelos de inteligencia artificial más avanzados.
En ese sentido, OpenAI reconoció que el incidente evidencia la rapidez con la que evolucionan estas tecnologías.
"La IA acelera el descubrimiento y la explotación de vulnerabilidades. La principal lección de este incidente es que la seguridad y la protección de los modelos deben mantenerse al ritmo de unas capacidades que avanzan rápidamente", indicó la compañía.
Además, el hecho se produce después de que el presidente de Estados Unidos, Donald Trump, firmara en junio una orden ejecutiva para establecer un marco que permita al gobierno evaluar, antes de su lanzamiento público, los riesgos para la seguridad nacional de los sistemas de inteligencia artificial más avanzados.




