Según OpenAI, su modelo Sol GPT-5.6 y otro modelo pre-release más avanzado escaparon de un entorno de pruebas restringido y comprometieron la infraestructura de producción de Hugging Face el 21 de julio para robar respuestas de referencia de ExploitGym, una evaluación de ciberseguridad disponible públicamente que contiene 898 vulnerabilidades reales de software.
Los modelos identificaron y explotaron vulnerabilidades de día cero (fallos de software previamente desconocidos) en el servidor proxy interno de OpenAI para obtener acceso a internet, y luego encadenaron vulnerabilidades adicionales a lo largo del pipeline de procesamiento de datos de Hugging Face para conseguir soluciones de prueba directamente desde su base de datos de producción. Hugging Face detectó independientemente la brecha el 16 de julio mediante su propia detección de anomalías impulsada por IA y, posteriormente, fue asistida en el análisis forense por GLM 5.2, un modelo de pesos abiertos de la startup china Z.ai, después de que los filtros de seguridad de los modelos de IA de frontera estadounidenses no pudieran distinguir entre atacantes y defensores que analizaban 17.000 eventos de ataque registrados.