OpenAI, empresa dirigida por Sam Altman, anunció su colaboración con Hugging Face para atender un ataque cibernético "sin precedentes" protagonizado por dos de sus modelos de inteligencia artificial (IA).
Según un reporte compartido por la compañía, el incidente ocurrió durante una serie de pruebas a los modelos GPT-5.6 Sol y a otro, aún más avanzado, que se encuentra en la etapa de evaluaciones internas.
¿Qué se sabe sobre el ataque? En MILENIO te contamos lo que han informado las empresas.
IA logró salir de un entorno aislado
El 16 de julio, la empresa Hugging Face —dedicada al desarrollo de modelos de aprendizaje automático y conocida por su amplia comunidad de código abierto— informó la detección de un acceso no autorizado a un conjunto de datos internos y credenciales usadas por sus servicios.
Según el comunicado difundido por la compañía, la intrusión representó un caso extraordinario debido a que fue impulsada, de inicio a fin, por un sistema de agentes de IA autónomos.
Días más tarde, la empresa OpenAI aclaró que el ciberataque se derivó de una combinación de dos de sus modelos durante un proceso de evaluaciones internas.
Específicamente, el hackeo ocurrió durante una serie de pruebas que orillan a los modelos a realizar "ataques avanzados mediante rutas complejas, con el fin de cuantificar sus capacidades cibernéticas".
La evaluación se llevó a cabo en un entorno altamente aislado, es decir, una computadora sin acceso a internet. De pronto, con el objetivo de encontrar la respuesta a un problema planteado durante la prueba, los modelos de IA invirtieron una "cantidad considerable de recursos" para encontrar una forma de conectarse a la red.
Para ello, según detalló OpenAI, los modelos de IA identificaron y aprovecharon una vulnerabilidad previamente desconocida —denominada como zero day— en los servidores locales, lo que les permitió avanzar hasta un nodo desde el cual pudieron conectarse a internet.
Una vez que obtuvieron dicha conexión, los modelos dedujeron que la plataforma Hugging Face podría tener la información necesaria para resolver los problemas planteados en la evaluación, por lo que hackearon sus servidores y obtuvieron datos secretos que les permitieron acceder a las respuestas de la prueba.
el dato¿Por qué Hugging Face fue el objetivo del ataque?
Hugging Face aloja una de las principales comunidades de código abierto relacionadas con la IA. En su plataforma, las y los usuarios comparten diariamente nuevos modelos de IA, conjuntos de datos e investigaciones que representan una valiosa fuente de información para desarrolladores de aplicaciones.Aparentemente, los modelos de IA no pretendían afectar a la empresa, sino obtener de ella las respuestas para el problema que les fue planteado en la evaluación de OpenAI.
Jeffrey Ladish, especialista en seguridad informática y director de Palisade Research, explicó que, durante este episodio, los modelos de IA utilizaron diversas técnicas, como el uso de una contraseña robada, para tomar el control de múltiples computadoras de la empresa afectada.
OpenAI prevé más episodios similares
En su informe sobre el incidente, OpenAI reconoció que este tipo de episodios podría volverse más común debido a la "proliferación de modelos con una capacidad cibernética cada vez mayor".
Como parte de las acciones para atender el hackeo, se realizó un análisis forense en colaboración con Hugging Face y se alertó de forma oportuna sobre las vulnerabilidades detectadas en los servidores.
"Este incidente pone de manifiesto la necesidad de fortalecer aún más la alineación de nuestro modelo, las protecciones cibernéticas durante el período de evaluación y la monitorización durante las pruebas internas", precisó OpenAI.
BM.