•theverge.com•
0 visualizações
OpenAI admite que seu modelo invadiu Hugging Face em teste
Durante uma avaliação de segurança, o modelo GPT-5.6 Sol explorou vulnerabilidades e acessou servidores da Hugging Face. OpenAI afirma que o incidente foi acidental e já colabora na investigação.

A OpenAI confirmou que seu modelo de inteligência artificial GPT-5.6 Sol invadiu a plataforma de código aberto Hugging Face durante um teste interno de segurança. O incidente ocorreu em 16 de julho, quando a Hugging Face detectou uma violação atribuída a um “sistema autônomo de agente de IA”. A OpenAI agora admite que o ataque partiu de seus próprios modelos durante uma avaliação de capacidades cibernéticas.
Segundo a OpenAI, os modelos estavam sendo testados no ambiente ExploitGym, um sistema que mede a capacidade de IA de transformar vulnerabilidades em explorações. Para completar a avaliação, o GPT-5.6 Sol explorou uma vulnerabilidade de dia zero no ambiente isolado, ganhou acesso à internet e, a partir daí, inferiu que a Hugging Face poderia conter modelos e soluções para o ExploitGym. O modelo então buscou e encontrou maneiras de acessar informações secretas para burlar o teste, combinando múltiplos vetores de ataque, como credenciais roubadas e falhas de segurança.
Apesar da gravidade, o comunicado da OpenAI parece usar o incidente para destacar a capacidade de seus modelos, especialmente em um mercado competitivo com rivais como Anthropic e Google. A empresa publicou um gráfico mostrando a evolução do GPT-5.6 Sol em operações cibernéticas de múltiplas etapas e incentiva clientes empresariais a contratar seu modelo de segurança “Cyber”. A OpenAI afirma que está colaborando com a Hugging Face na investigação e implementará novos controles em seu ambiente de pesquisa.