Início NOTÍCIAS OpenAI capacita IA, saiu da caixa de areia e quebrou Hugging Face

OpenAI capacita IA, saiu da caixa de areia e quebrou Hugging Face

22
0

TL, DR *

OpenAI diz que GPT-5.6 Sun e o modelo seguro não chocável foram testados, nada foi usado hoje e o rosto de Hugging foi hackeado para enganar colegas em segurança cibernética.

OpenAI disse na terça-feira Dois protótipos da sua IA, incluindo o carro-chefe da Sun, escaparam de um ambiente de teste seguro, procuraram acesso à Internet, exploraram uma vulnerabilidade de dia zero em software de terceiros e invadiram a infraestrutura da Hugging Face. A empresa chamou o incidente de “inédito”E disse que foram encontradas comunicações preliminares para ajudar os defensores a entender quais modelos finais eles podem fazer agora.

Ambos os modelos foram executados com uma proteção de segurança cibernética inferior, como parte de uma avaliação interna das suas capacidades ofensivas. Eles foram testados no ExploitGym, um teste de segurança cibernética prontamente disponível, e determinaram que as respostas ao teste foram armazenadas nos sistemas de produção do Hugging Face.

Em vez de pagar uma estimativa pela mente, os modelos seguiram o gabarito. Eles são consumidos pelo que a OpenAI descreve como “calcular uma quantidade substancial de inferência“Encontrando uma maneira de sair de seu ambiente de área restrita, eles vincularam duas vulnerabilidades de execução remota de código aos pipelines de processamento de conjunto de dados do Hugging Face. O ataque à nuvem e o cluster de documentos foram encerrados, movidos lateralmente para ligações internas e mais de 17.000 ações individuais foram brevemente ativas nas sandboxes de exame, de acordo com a divulgação do próprio Hugging Face em 16 de julho.

Tecnologia da UE

As últimas notícias sobre o cenário tecnológico da UE, uma história sobre os sábios do autor Boris e alguma arte questionável de IA. É grátis, toda semana, na sua caixa de entrada. Cadastre-se agora!

Abraçando o Rosto, ele disse que detectou a intrusão, a conteve e consertou os nós do prédio. A empresa não encontrou evidências de adulteração de modelos públicos, conjuntos de dados ou espaços públicos, e a cadeia de abastecimento da concorrência estava limpa. Ainda estamos avaliando se algum dado da empresa ou do cliente foi afetado.

Para investigar a violação, a Face Hugging recorreu ao GLM, um modelo chinês de código aberto, porque os vigilantes do mercado dos EUA impediram a empresa de executar os seus próprios modelos comerciais em processos judiciais.

Escape não é a primeira vez que Sol sofre uma queda nas classificações de seu jogo. A organização Model Assessment and Threat Research, um laboratório independente que aprimorou o modelo antes do lançamento, descobriu que as culturas agressivas de seus sujeitos de teste inflacionaram as pontuações de agressividade. Num caso, um hacker envolvido no fluxo de dados obteve privilégios no servidor de avaliação e vazou as respostas corretas que haviam sido ocultadas dos avaliadores humanos.

O padrão mais amplo de fracasso dos agentes de segurança de IA acelerou acentuadamente, com quatro equipas de investigação distintas a reprimir os agentes de IA de quatro maneiras, apenas nos primeiros dez dias de Julho. A OpenAI e a Anthropic enfrentaram o mais alto escrutínio das capacidades de segurança cibernética dos seus modelos, com a administração Trump restringindo o acesso aos sistemas mais recentes de ambas as empresas durante uma revisão governamental.

A OpenAI detectou o ataque Face Hugging e estendeu-o para detectá-lo, mas a essa altura, o Face Hugging já havia sido identificado e continha a violação em si. A situação mostra que a lacuna entre os modelos de IA que podem encontrar vulnerabilidades e os modelos de IA que as exploram sem permissão é menor do que qualquer pessoa na indústria reconheceu publicamente.

Source link

DEIXE UMA RESPOSTA

Por favor digite seu comentário!
Por favor, digite seu nome aqui