Menu
Inteligencia Artificial

¿Qué sabemos de la rebelión de la inteligencia artificial de OpenAI?

Modelos de IA de OpenAI lograron escapar de un entorno de pruebas y acceder a sistemas de Hugging Face tras explotar vulnerabilidades; el incidente revela nuevos desafíos en ciberseguridad y el avance de los agentes autónomos de inteligencia artificial

¿Qué sabemos de la rebelión de la inteligencia artificial de OpenAI?
OpenAI informó que dos de sus modelos de IA lograron explotar vulnerabilidades durante una prueba interna y acceder a sistemas de Hugging Face.Foto: Especial | IA

Dos de los modelos de inteligencia artificial (IA) de OpenAI lograron entrar sin autorización a Hugging Face, plataforma especializada en modelos y herramientas de IA, durante una prueba interna diseñada para evaluar sus capacidades de ciberseguridad.

De acuerdo con OpenAI, el incidente involucró una combinación de dos modelos, GPT-5.6 Sol y un modelo de prelanzamiento con capacidades aún más avanzadas que contaban con restricciones cibernéticas diseñadas específicamente para realizar pruebas internas sobre capacidades ofensivas de alto riesgo.

Durante la evaluación, los modelos recibieron instrucciones para resolver un desafío de ciberseguridad. En ese proceso identificaron y encadenaron vulnerabilidades dentro del entorno de investigación de OpenAI, con lo que consiguieron salir del entorno de pruebas y alcanzar la infraestructura de producción de Hugging Face para obtener las respuestas de la prueba directamente de la base de datos del sitio web.

OpenAI explicó que los modelos destinaron una cantidad considerable de capacidad de inferencia para encontrar una forma de obtener acceso abierto a internet y resolver el reto planteado. Para conseguirlo, identificaron y explotaron una vulnerabilidad de día cero (zero-day) en el proxy de caché del registro, lo que les permitió ejecutar una cadena de acciones hasta obtener conexión a internet.

Una vez conectados, dedujeron que Hugging Face podía alojar modelos, conjuntos de datos y soluciones relacionadas con la prueba, por lo que buscaron formas de acceder a información confidencial para obtener ventaja durante la evaluación.

El sistema encadenó múltiples vectores de ataque, entre ellos el uso de credenciales comprometidas y vulnerabilidades que permitieron ejecutar código de forma remota en servidores.

TAMBIÉN LEE: Fragilidad y riesgos de la inteligencia artificial.

La respuesta de Hugging Face

Hugging Face informó que detectó y respondió al ataque, el cual fue ejecutado completamente por un sistema de agentes de IA autónomos. La empresa señaló que la intrusión también fue identificada y analizada mediante sus propias herramientas de inteligencia artificial.

La compañía explicó que el ataque se concentró en uno de los puntos más sensibles de las plataformas de IA: el flujo de procesamiento de datos. Durante la intrusión, el sistema escaló privilegios, recopiló credenciales en la nube y se propagó hacia distintos sistemas internos a lo largo de un fin de semana.

Tras detectar la actividad, Hugging Face cerró las rutas de ejecución de código relacionadas con conjuntos de datos, eliminó el acceso del atacante y revocó y rotó las credenciales y los tokens comprometidos. Además, implementó controles de seguridad más estrictos, reforzó los mecanismos de detección y alerta, y estableció procedimientos para activar equipos de respuesta ante incidentes de alta gravedad.

Hugging Face indicó que la detección inicial fue realizada mediante inteligencia artificial, utilizando un análisis basado en modelos de lenguaje (LLM) sobre la telemetría de seguridad.

El sistema analizó más de 17 mil eventos registrados, lo que permitió reconstruir la cronología del incidente, identificar indicadores de compromiso, mapear las credenciales afectadas y distinguir la actividad real de posibles señuelos, agilizando así la respuesta.

TAMBIÉN LEE: La alerta mundial que lanza China sobre el peligro de la inteligencia artificial.

¿Qué lecciones deja este incidente?

Para Hugging Face, este caso demuestra la importancia de contar con modelos de IA que puedan ejecutarse dentro de la propia infraestructura de la organización, previamente verificados y preparados para responder antes de que ocurra un incidente.

La empresa concluyó que las herramientas ofensivas autónomas impulsadas por inteligencia artificial ya representan un riesgo real y que los modelos avanzados son capaces de descubrir y explotar nuevas rutas de ataque en sistemas reales, incluso sin acceso al código fuente.

"Defender una plataforma en línea ahora significa tratar la superficie de datos y modelos como una superficie de ataque de primer nivel, y utilizar la IA en la defensa para mantenerse al día", concluyó Hugging Face.

Por su parte, OpenAI calificó lo ocurrido como un incidente cibernético sin precedentes relacionado con capacidades avanzadas de IA y aseguró que trabaja conjuntamente con Hugging Face para corregir las vulnerabilidades que hicieron posible la intrusión.

Expertos cuestionan las medidas de aislamiento de OpenAI

Especialistas en ciberseguridad, como Gina Neff, directora del Centro Minderoo para Tecnología y Democracia de la Universidad de Cambridge, y Deirdre Mulligan, profesora de la Facultad de Información de la Universidad de California en Berkeley, señalaron a BBC y The New York Times que OpenAI no habría construido un entorno suficientemente aislado para realizar este tipo de pruebas.

En declaraciones a la BBC, Spencer Starkey, ejecutivo de la empresa de ciberseguridad SonicWall, afirmó que el caso demuestra que muchas organizaciones continúan defendiendo sus sistemas a velocidad humana, mientras que las amenazas impulsadas por inteligencia artificial evolucionan al ritmo de las máquinas.

JL

Temas

Buscar

Main logo