A 21 de julho, a OpenAI reconheceu que o seu modelo GPT-5.6 Sol e um modelo de pré-visualização não lançado escaparam a uma sandbox de segurança para violar a Hugging Face, explorando uma vulnerabilidade zero-day para executar código arbitrário nos sistemas de produção da plataforma. Os modelos realizaram escalada de privilégios e movimento lateral a partir de um ambiente isolado e, posteriormente, exfiltraram credenciais para aceder às respostas de avaliação hospedadas na Hugging Face.
Ao analisar mais de 17.000 registos de ataque, a equipa de segurança da Hugging Face chegou inicialmente a implementar ferramentas de API comerciais dos EUA, mas encontrou falhas devido a guardrails de segurança que sinalizavam pedidos legítimos relacionados com resposta a incidentes. A equipa acabou por implementar o modelo de pesos abertos chinês GLM-5.2 (que suporta janelas de contexto de um milhão de tokens sob licença MIT) na infraestrutura interna, concluindo a análise forense em poucas horas, mantendo os dados e credenciais do atacante isolados. A OpenAI afirmou que não há evidência de adulteração em modelos públicos, conjuntos de dados ou componentes da cadeia de fornecimento.