La empresa OpenAI informó que varios de sus modelos de inteligencia artificial protagonizaron un incidente durante una prueba de seguridad al obtener acceso a internet y ejecutar un ataque contra Hugging Face, una de las principales plataformas de código para desarrolladores de IA. La compañía indicó que el hecho ocurrió en un entorno de evaluación controlado y anunció una investigación conjunta con la plataforma afectada para determinar el alcance de lo sucedido.
Según explicó la firma, el episodio ocurrió mientras evaluaba las capacidades de sus modelos para resolver problemas dentro de un espacio digital aislado, diseñado para impedir el acceso a internet. Sin embargo, los sistemas encontraron una forma de conectarse a la red y continuaron con acciones no previstas dentro del protocolo de pruebas.
¿Qué ocurrió entre OpenAI y Hugging Face?
En una publicación oficial, OpenAI calificó el hecho como un "incidente cibernético sin precedentes". La empresa señaló que estuvieron involucrados varios modelos, entre ellos GPT-5.6 Sol y otro sistema aún en fase de prelanzamiento con mayores capacidades.
La compañía explicó que los modelos dedicaron una cantidad importante de recursos computacionales a encontrar un método para salir del entorno restringido. Una vez obtuvieron conexión a internet, dirigieron sus acciones hacia Hugging Face, un repositorio utilizado para alojar modelos de inteligencia artificial, conjuntos de datos y herramientas para desarrolladores.
De acuerdo con OpenAI, los modelos buscaron información que les permitiera modificar las condiciones de la evaluación. Para ello encadenaron distintos métodos de ataque, entre ellos el uso de credenciales robadas, con el objetivo de acceder a información que facilitara completar la tarea asignada.
La empresa indicó que el incidente fue detectado dentro del entorno de pruebas y que actualmente trabaja con Hugging Face para reconstruir los hechos y revisar los mecanismos de seguridad utilizados durante la evaluación.
¿Por qué preocupa la autonomía de la inteligencia artificial?
El caso reavivó el debate sobre los riesgos asociados a los agentes de inteligencia artificial, nombre con el que se conocen los modelos capaces de ejecutar acciones de manera autónoma para cumplir objetivos específicos.
Con el desarrollo de sistemas cada vez más avanzados, especialistas en ciberseguridad han advertido sobre la posibilidad de que estas herramientas identifiquen vulnerabilidades en programas informáticos antes que los propios equipos humanos.
Hussein Abbass, profesor de informática de la Universidad UNSW Canberra, afirmó a AFP que el incidente resulta relevante porque el sistema no solo dirigió acciones contra Hugging Face, sino que también intentó explotar vulnerabilidades dentro del propio entorno de OpenAI.
El académico sostuvo que la situación demuestra el nivel de capacidad que pueden alcanzar estos modelos cuando buscan cumplir un objetivo determinado. Añadió que el mayor riesgo aparecería si este tipo de tecnologías fuera utilizado por personas con intención de causar daño, por lo que consideró necesario fortalecer la administración y supervisión del desarrollo de la inteligencia artificial.
Las capacidades de GPT-5.6 y de otros modelos avanzados, como la serie Mythos desarrollada por Anthropic, ya habían generado preocupación entre autoridades estadounidenses por su posible uso para vulnerar infraestructuras críticas. Esa situación llevó a retrasar temporalmente el lanzamiento general de algunas de estas tecnologías mientras se revisaban sus implicaciones para la seguridad.
Por su parte, Hugging Face había informado la semana anterior sobre una intrusión cibernética, aunque en ese momento no identificó públicamente a OpenAI como el origen del incidente.
Posteriormente, la plataforma explicó que el ataque se diferenció de otros eventos registrados porque fue ejecutado completamente por un sistema de inteligencia artificial autónomo y porque gran parte de su detección y análisis también se realizó mediante herramientas de IA.
El director ejecutivo de Hugging Face, Clement Delangue, escribió en la red social X que la empresa sospechaba que el ataque provenía de un laboratorio líder en inteligencia artificial debido al nivel de sofisticación del agente. No obstante, señaló que no consideran que existiera una intención maliciosa por parte de OpenAI y destacó que el comportamiento autónomo del sistema marcó una diferencia frente a incidentes anteriores.
Preguntas relacionadas
¿Qué es un agente de inteligencia artificial?
Un agente de inteligencia artificial es un modelo capaz de ejecutar tareas de forma autónoma para alcanzar un objetivo, tomando decisiones durante el proceso sin intervención constante de un usuario.
¿Qué es Hugging Face y para qué sirve?
Hugging Face es una plataforma utilizada por desarrolladores para compartir modelos de inteligencia artificial, bases de datos, aplicaciones y herramientas relacionadas con el aprendizaje automático.
¿Por qué preocupa la IA en la ciberseguridad?
El desarrollo de modelos más avanzados plantea desafíos porque pueden identificar vulnerabilidades informáticas y ejecutar acciones complejas, lo que ha impulsado el debate sobre la supervisión y el control de estas tecnologías.