De acordo com o post do blog da OpenAI na terça-feira, os modelos de IA da empresa GPT-5.6 Sol e um modelo ainda não lançado conseguiram escapar de um ambiente de treinamento isolado (sandbox), acessar a internet e explorar uma vulnerabilidade para invadir os sistemas da Hugging Face. Os modelos tentavam encontrar informações para trapacear em uma avaliação, disse a OpenAI. As duas empresas estão investigando ativamente o incidente.
O CEO da Hugging Face, Clément Delangue, disse no X que a plataforma acredita que não houve intenção maliciosa e descreveu a invasão autônoma como “mind-blowing”. A OpenAI afirmou que está reforçando o confinamento, o monitoramento, os controles de acesso e as práticas de avaliação durante o desenvolvimento dos modelos.