¿Cómo fue que dos modelos de IA hackearon de forma autónoma a la empresa Hugging Face? Esto sabemos del ciberataque

Dos modelos de OpenAI lograron salir de un entorno sin acceso a internet para obtener contraseñas de la plataforma afectada.

La empresa OpenAI, encabezada por Sam Altman, inició una investigación por el ataque que involucró a dos de sus modelos | SHUTTERSTOCK
Ciudad de México /
Únete al canal de Milenio

OpenAI, empresa dirigida por Sam Altman, anunció su colaboración con Hugging Face para atender un ataque cibernético "sin precedentes" protagonizado por dos de sus modelos de inteligencia artificial (IA).

Según un reporte compartido por la compañía, el incidente ocurrió durante una serie de pruebas a los modelos GPT-5.6 Sol y a otro, aún más avanzado, que se encuentra en la etapa de evaluaciones internas.

Te recomendamos...
¿Los modelos de IA especializados y baratos desafían a las grandes firmas?

¿Qué se sabe sobre el ataque? En MILENIO te contamos lo que han informado las empresas.

IA logró salir de un entorno aislado

El 16 de julio, la empresa Hugging Face —dedicada al desarrollo de modelos de aprendizaje automático y conocida por su amplia comunidad de código abierto— informó la detección de un acceso no autorizado a un conjunto de datos internos y credenciales usadas por sus servicios.

Según el comunicado difundido por la compañía, la intrusión representó un caso extraordinario debido a que fue impulsada, de inicio a fin, por un sistema de agentes de IA autónomos.

Días más tarde, la empresa OpenAI aclaró que el ciberataque se derivó de una combinación de dos de sus modelos durante un proceso de evaluaciones internas.

Específicamente, el hackeo ocurrió durante una serie de pruebas que orillan a los modelos a realizar "ataques avanzados mediante rutas complejas, con el fin de cuantificar sus capacidades cibernéticas".

La evaluación se llevó a cabo en un entorno altamente aislado, es decir, una computadora sin acceso a internet. De pronto, con el objetivo de encontrar la respuesta a un problema planteado durante la prueba, los modelos de IA invirtieron una "cantidad considerable de recursos" para encontrar una forma de conectarse a la red.

Para ello, según detalló OpenAI, los modelos de IA identificaron y aprovecharon una vulnerabilidad previamente desconocida —denominada como zero day— en los servidores locales, lo que les permitió avanzar hasta un nodo desde el cual pudieron conectarse a internet.

Una vez que obtuvieron dicha conexión, los modelos dedujeron que la plataforma Hugging Face podría tener la información necesaria para resolver los problemas planteados en la evaluación, por lo que hackearon sus servidores y obtuvieron datos secretos que les permitieron acceder a las respuestas de la prueba.

el dato

¿Por qué Hugging Face fue el objetivo del ataque?

Hugging Face aloja una de las principales comunidades de código abierto relacionadas con la IA. En su plataforma, las y los usuarios comparten diariamente nuevos modelos de IA, conjuntos de datos e investigaciones que representan una valiosa fuente de información para desarrolladores de aplicaciones.

Aparentemente, los modelos de IA no pretendían afectar a la empresa, sino obtener de ella las respuestas para el problema que les fue planteado en la evaluación de OpenAI.

Jeffrey Ladish, especialista en seguridad informática y director de Palisade Research, explicó que, durante este episodio, los modelos de IA utilizaron diversas técnicas, como el uso de una contraseña robada, para tomar el control de múltiples computadoras de la empresa afectada.

OpenAI prevé más episodios similares

En su informe sobre el incidente, OpenAI reconoció que este tipo de episodios podría volverse más común debido a la "proliferación de modelos con una capacidad cibernética cada vez mayor".

Como parte de las acciones para atender el hackeo, se realizó un análisis forense en colaboración con Hugging Face y se alertó de forma oportuna sobre las vulnerabilidades detectadas en los servidores.

"Este incidente pone de manifiesto la necesidad de fortalecer aún más la alineación de nuestro modelo, las protecciones cibernéticas durante el período de evaluación y la monitorización durante las pruebas internas", precisó OpenAI.


BM.

  • Baruc Mayen
  • Editor digital en la Unidad de Crecimiento de Milenio. Especialista en investigaciones a profundidad sobre derechos humanos, violencia y seguridad. Comunicólogo egresado de la FCPyS de la UNAM y apasionado de la fotografía.

LAS MÁS VISTAS

¿Ya tienes cuenta? Inicia sesión aquí.

Crea tu cuenta ¡GRATIS! para seguir leyendo

No te cuesta nada, únete al periodismo con carácter.

Hola, todavía no has validado tu correo electrónico

Para continuar leyendo da click en continuar.

Suscríbete al
periodismo con carácter y continua leyendo sin límite