La empresa informó que el hecho ocurrió durante una evaluación interna de capacidades de ciberseguridad. OpenAI y Hugging Face investigan el incidente, que calificaron como un caso sin precedentes.
OpenAI dio a conocer un incidente de seguridad ocurrido durante una serie de pruebas internas con algunos de sus modelos de inteligencia artificial más avanzados. De acuerdo con la compañía, los sistemas lograron obtener acceso no autorizado a internet desde un entorno de evaluación y posteriormente dirigieron acciones contra la plataforma Hugging Face con el objetivo de obtener información para resolver una prueba de ciberseguridad.
La empresa describió el episodio como un incidente «sin precedentes» y anunció que trabaja de manera conjunta con Hugging Face para determinar cómo ocurrió y reforzar las medidas de protección.
Hugging Face detectó la actividad durante la intrusión
El caso comenzó a conocerse después de que Hugging Face informara que había detectado y contenido una intrusión en parte de su infraestructura tecnológica. Posteriormente, OpenAI confirmó que la actividad provenía de una combinación de modelos experimentales, entre ellos GPT-5.6 Sol y otro modelo aún no publicado, utilizados durante una evaluación interna con restricciones de ciberseguridad reducidas para medir sus capacidades.
Según ambas compañías, el comportamiento fue detectado y contenido antes de que se produjera un impacto mayor, mientras continúan las investigaciones sobre lo ocurrido.
Los modelos buscaron acceso a internet durante la evaluación
OpenAI explicó que los modelos operaban dentro de un entorno aislado diseñado para evaluar habilidades avanzadas de ciberseguridad. Durante la prueba, los sistemas destinaron recursos para encontrar una forma de conectarse a internet con el propósito de obtener información que les permitiera completar el ejercicio.
La empresa indicó que, una vez obtenido ese acceso, los modelos encadenaron distintos métodos de ataque, incluyendo el uso de credenciales comprometidas y la explotación de vulnerabilidades, para intentar acceder a información almacenada en Hugging Face relacionada con la evaluación.
El caso reaviva el debate sobre la seguridad de la IA
El incidente generó nuevas discusiones sobre el desarrollo de agentes de inteligencia artificial capaces de ejecutar tareas de manera autónoma.
El cofundador y director ejecutivo de Hugging Face, Clement Delangue, señaló que el episodio demuestra la importancia de fortalecer la colaboración entre organizaciones para mejorar la seguridad de estos sistemas. Por su parte, OpenAI afirmó que reforzará sus mecanismos de contención, monitoreo y control durante el desarrollo y evaluación de modelos avanzados.
Hasta el momento, ambas compañías mantienen abierta la investigación y han señalado que compartirán más detalles técnicos una vez que concluya el análisis del incidente.




