Modelos de OpenAI acceden a sistemas de Hugging Face durante una prueba de ciberseguridad, tras combinar fallas y usar credenciales robadas.
Dos modelos avanzados de inteligencia artificial de OpenAI lograron acceder sin autorización a sistemas internos de Hugging Face durante una evaluación controlada de ciberseguridad. El incidente se produjo mientras ambos sistemas participaban en ExploitGym, una prueba diseñada para medir su capacidad de detectar y explotar vulnerabilidades complejas dentro de un entorno aislado.
De acuerdo con la información divulgada, los modelos encontraron varias fallas en la infraestructura utilizada para la prueba y, al combinarlas, alcanzaron una computadora con conexión abierta a internet. Desde allí, identificaron que Hugging Face podía contener información útil para el examen y utilizaron credenciales robadas, junto con una vulnerabilidad desconocida, para entrar a servidores internos de la plataforma. OpenAI aclaró que no se trató del ChatGPT de uso cotidiano ni de una supuesta “rebelión” de las máquinas, sino de sistemas puestos a prueba con menos restricciones de seguridad de las habituales.
Hugging Face indicó que el acceso afectó un grupo limitado de bases de datos internas y varias credenciales de sus servicios, aunque hasta ahora no ha encontrado evidencia de modificaciones en modelos, aplicaciones públicas o bases de datos disponibles para los usuarios. La empresa recomendó cambiar claves de acceso y vigilar actividad inusual en las cuentas, mientras los equipos de seguridad de ambas compañías continúan investigando lo ocurrido. OpenAI, por su parte, aseguró que reforzará las protecciones en futuras evaluaciones para evitar que un episodio similar vuelva a repetirse.











Discusión sobre esto post