A OpenAI anunciou que seu modelo de IA foi acidentalmente comprometido pela plataforma de IA de código aberto Hugging Face durante testes internos. em Postagem de terça-feira no blogA OpenAI escreveu que o GPT-5.6 Sol e “um modelo de pré-lançamento ainda mais capaz” descobriram a vulnerabilidade em um ambiente de teste sandbox, permitindo que ele acesse a Internet e tenha como alvo o Hugging Face.
16 de julho Abraço Rosto Publicou um incidente de segurança Ele afirma ser alimentado por um “sistema de agente autônomo de IA”. O agente de IA da Hugging Face detectou e interrompeu essa violação, e a OpenAI agora reconheceu que a violação ocorreu ao avaliar as capacidades de segurança cibernética de seu modelo. A OpenAI disse que “todas as evidências indicam que o modelo estava focado em encontrar uma solução para o ExploitGym, um sistema de benchmark que mede se os modelos de IA podem transformar vulnerabilidades de segurança em explorações”.
Como parte dos nossos esforços para concluir a avaliação, o nosso modelo de IA conseguiu aceder à Internet explorando uma vulnerabilidade de dia zero num ambiente sandbox. A partir daí, a OpenAI disse que seus modelos “inferiram que o Hugging Face pode estar hospedando modelos, conjuntos de dados e soluções do ExploitGym” e “procurou e conseguiu acessar informações confidenciais que poderiam ser usadas para enganar a avaliação”.
Em um exemplo, esse modelo encadeou vários vetores de ataque, incluindo o uso de credenciais roubadas e vulnerabilidades de dia zero para encontrar um caminho de execução remota de código no servidor Hugging Face.
Mas embora este incidente seja grave, a OpenAI parece estar a usar este ataque “sem precedentes” como uma oportunidade para melhorar a aparência dos seus sistemas de IA, especialmente porque compete com rivais de segurança cibernética como o Mythos da Anthropic e o Gemini Flash 3.5 Cyber. A postagem do blog da OpenAI apresenta gráficos que mostram como o GPT-5.6 Sol melhora na manutenção de vários níveis de operações cibernéticas e também incentiva os clientes corporativos a se inscreverem para acessar seu modelo de segurança “cibernética”.
A OpenAI acrescentou que está atualmente trabalhando com a Hugging Face para investigar o incidente de segurança e planeja implementar novos controles no ambiente de pesquisa.


