OpenAI informó que sus modelos de inteligencia artificial realizaron de manera independiente un ciberataque sin precedente a los sistemas de Hugging Face durante una evaluación interna de seguridad. El incidente involucró al modelo GPT-5.6 Sol y a otro más avanzado en fase de prueba, que escaparon de un entorno controlado, accedieron a internet y explotaron credenciales robadas junto con una vulnerabilidad desconocida.
Sam Altman, director ejecutivo de OpenAI, confirmó el suceso en un comunicado y destacó que la IA alcanzó extremos para cumplir un objetivo de prueba limitado, lo que incluyó ejecución remota de código en los servidores de la plataforma. Hugging Face detectó la intrusión la semana anterior y su cofundador Clément Delangue señaló la sofisticación del agente autónomo, aunque confirmó la ausencia de intención maliciosa y la colaboración posterior entre ambas empresas.
La compañía enfatizó la necesidad de que las medidas de seguridad avancen al ritmo de las capacidades de los modelos, en un contexto de crecientes preocupaciones sobre riesgos cibernéticos de la IA. Hugging Face contuvo el incidente rápidamente, corrigió vulnerabilidades y rotó credenciales sin impacto en sus modelos o datos públicos, en lo que podría constituir el primer caso de este tipo.
