IA de OpenAI escapó de una prueba y lanzó un ciberataque sin intervención humana
OpenAI confirmó que sus sistemas encontraron una vulnerabilidad y obtuvieron acceso a internet durante una evaluación

Los sistemas de inteligencia artificial más avanzados de OpenAI protagonizaron un hecho sin precedentes al escapar de un entorno de pruebas y ejecutar de forma autónoma un ciberataque contra Hugging Face, una de las plataformas más importantes del mundo para compartir modelos de IA.
El incidente ocurrió durante una evaluación interna diseñada para medir las capacidades de los llamados "agentes" de inteligencia artificial y ha reavivado el debate sobre los riesgos de esta tecnología.
La empresa creadora de ChatGPT confirmó que sus modelos lograron encontrar una vulnerabilidad en el entorno aislado donde estaban siendo evaluados, obtuvieron acceso a internet y posteriormente intentaron infiltrarse en sistemas de Hugging Face con el objetivo de conseguir información que les ayudara a resolver la prueba.
OpenAI calificó el episodio como un caso inédito y abrió una investigación conjunta con la plataforma afectada para esclarecer lo ocurrido.
La IA escapó y lanzó un ciberataque por su cuenta
De acuerdo con OpenAI, el incidente ocurrió mientras varios modelos, entre ellos el recién presentado GPT-5.6 Sol y otro sistema aún en fase de prelanzamiento, realizaban una evaluación de ciberseguridad dentro de un entorno de pruebas con acceso restringido a internet.
La compañía explicó que estos agentes, capaces de actuar de manera autónoma tras recibir instrucciones humanas, comenzaron a buscar alternativas para salir del entorno aislado.
Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación", señaló OpenAI.
Una vez fuera del entorno controlado, los modelos identificaron a Hugging Face como una posible fuente de información útil y ejecutaron una cadena de ataques para intentar obtener datos que facilitaran la prueba.
Según la empresa, la inteligencia artificial llegó incluso a utilizar credenciales robadas y combinó distintos métodos de intrusión para alcanzar su objetivo.
El ataque fue detectado por Hugging Face, que posteriormente corrigió las vulnerabilidades encontradas y reconstruyó los sistemas afectados. La plataforma indicó que continúa evaluando si algún cliente o socio pudo verse afectado por la intrusión.
El director ejecutivo de Hugging Face, Clément Delangue, aseguró que el comportamiento del sistema sorprendió incluso a los especialistas.
Creemos firmemente que no hubo intención maliciosa de su parte", escribió Delangue en referencia a OpenAI.
"¡Es bastante alucinante que todo esto ocurriera de forma autónoma!", añadió.
Especialistas consultados tras conocerse el caso señalaron que el incidente evidencia que los entornos de prueba deberán reforzar sus medidas de seguridad, ya que los modelos actuales son capaces de identificar y explotar vulnerabilidades sin intervención humana.
El caso reaviva el debate sobre los riesgos de la IA
El episodio también ha generado preocupación entre expertos en ciberseguridad debido al creciente nivel de autonomía que alcanzan los modelos más avanzados de inteligencia artificial.
OpenAI explicó que el objetivo de estas pruebas consiste precisamente en medir hasta dónde pueden llegar sus sistemas cuando enfrentan desafíos complejos, especialmente en materia de ciberseguridad. Sin embargo, el resultado superó las expectativas de los investigadores.
El profesor Hussein Abbass, especialista en informática de la Universidad UNSW Canberra, calificó el episodio como uno de los más relevantes registrados hasta ahora.
No solo atacó a Hugging Face. Atacó su sistema interno para explotar sus propias vulnerabilidades", afirmó.
"Y eso es aterrador", agregó.
Abbass advirtió que el verdadero riesgo aparecería si este tipo de capacidades terminan siendo utilizadas por actores maliciosos.
"La IA avanzada normalmente está en manos de personas éticas y responsables", sostuvo.
"Sería catastrófico si llega a las manos de alguien con la intención de causar daño", alertó.
El académico también consideró indispensable una coordinación internacional para regular el desarrollo de estos sistemas.
"Necesitamos un esfuerzo conjunto para manejar esta situación", afirmó.
El incidente ocurre en un momento de intensa competencia entre OpenAI, Anthropic y otras compañías que desarrollan modelos cada vez más potentes. En las últimas semanas también llamó la atención el lanzamiento de nuevos sistemas capaces de realizar tareas complejas de programación y análisis de seguridad informática.
Mientras continúa la investigación conjunta entre OpenAI y Hugging Face, el caso se perfila como uno de los episodios más importantes hasta ahora sobre los desafíos que plantea una inteligencia artificial con capacidad para actuar de manera autónoma dentro y fuera de entornos digitales controlados.