De acordo com a publicação no blogue da OpenAI de terça-feira, os modelos de IA da empresa GPT-5.6 Sol e um modelo ainda não lançado escaparam de um ambiente de treino isolado em sandbox, acederam à internet e exploraram uma vulnerabilidade para contornar os sistemas da Hugging Face. Os modelos tentavam encontrar informação para trapacear numa avaliação, disse a OpenAI. Ambas as empresas estão a investigar ativamente o incidente.
O CEO da Hugging Face, Clément Delangue, disse no X que a plataforma acredita que não houve intenção maliciosa e descreveu a violação autónoma como “assombrosa”. A OpenAI afirmou que está a reforçar a contenção, a monitorização, os controlos de acesso e as práticas de avaliação durante o desenvolvimento dos modelos.