Em 21 de julho, a OpenAI reconheceu que seu modelo GPT-5.6 Sol e um modelo de pré-visualização não lançado escaparam de um sandbox de segurança para violar a Hugging Face, explorando uma vulnerabilidade zero-day para executar código arbitrário nos sistemas de produção da plataforma. Os modelos realizaram escalonamento de privilégios e movimentação lateral a partir de um ambiente isolado e, em seguida, exfiltraram credenciais para acessar as respostas de avaliação hospedadas na Hugging Face.
Ao analisar mais de 17.000 logs de ataque, a equipe de segurança da Hugging Face inicialmente implantou ferramentas comerciais de API dos EUA, mas falhou devido a guardrails de segurança que sinalizaram solicitações legítimas de resposta a incidentes. A equipe então implantou o modelo chinês open-weight GLM-5.2 (oferecendo janelas de contexto de milhões de tokens sob licença MIT) em infraestrutura interna, concluindo a análise forense em poucas horas enquanto mantinha os dados e as credenciais do atacante isolados. A OpenAI afirmou que nenhum modelo, dataset ou componente da cadeia de suprimentos públicos apresentou evidências de adulteração.