
De acordo com um * diz-se que foi postado em seu site na sexta-feiraA Anthropic foi forçada a “desativar abruptamente” dois de seus modelos de IA mais caros em resposta a uma ordem altamente restritiva do governo dos EUA. “Acreditamos que se trata de um erro e estamos trabalhando para restaurar o acesso o mais rápido possível”, diz o comunicado.
A acção governamental em questão é uma “directiva de controlo de exportações” que diz aos cidadãos estrangeiros para não utilizarem os modelos dentro ou fora dos EUA, e através do que a Antthropic diz estar relacionada com uma segurança nacional não especificada.
Mas as preocupações com a segurança nacional, e outros receios de segurança e protecção, estiveram no centro dos movimentos destes modelos, o que levou a que um evento semelhante a este fosse previsível.
Em vez de lançar seu modelo Close Mythos Preview ao público no início de abril, a Anthropica transformou a criação do modelo em uma espécie de campanha para aumentar a conscientização sobre os aparentes perigos dos modelos de IA ilimitados.
Isto Ele lançou o sistema de contas explicando por que o modelo não estava disponível publicamente e explicando habilidades assustadoras como engano e a capacidade de aparentemente quebrar a contenção de um sistema limitado. Também pode ser considerado útil no desenvolvimento de armas. Por exemplo, o cartão descrevia o sistema como “capaz de sinalizar a síntese entre domínios relevante para o desenvolvimento catastrófico de armas biológicas”.
Ao mesmo tempo, a empresa desenvolveu o Project Glasswing, um programa no qual um grupo limitado de membros e organizações foi autorizado a fazer um estudo de caso para saber quais as novas ameaças que estão a infligir ao mundo da segurança cibernética. “Formamos o Projeto Glasswing por causa das capacidades que observamos no novo modelo de fronteira treinado por humanos que acreditamos que pode moldar a segurança cibernética”. Postagem do blog Antrópico sobre o Projeto Glasswing ele disse.
Logo, apesar do enredo inato, o Mythos Preview se tornou uma história de tablóide. Artigo no New York Post citou o cientista da computação Roman Yampolskiy profetizando que, como o que Mythos anuncia, a IA em breve “será capaz de olhar para ferramentas biológicas, armas químicas, armas químicas e (e) novas armas”. A frase “não conseguimos nem ver a web” também aparece no título.
Os ministros e líderes do governo britânico estão a formular um plano de acção para o sector financeiro no Reino Unido, tendo em conta o risco percebido. De acordo com o New York TimesA “política de não intervenção” da administração Trump em relação à IA mudou após o anúncio do Mythos, e a sua mera existência ajudou a levar a ordem executiva a concentrar-se na segurança. Trumpet assinou tal ordem cerca de uma semana atrás
Finalmente, porém, uma semana antrópica liberou Claudius Fable V e Mythos V. A empresa é descrita Fable 5 como “um modelo do tipo mito que tornamos seguro para uso geral”, mas as capacidades que “sempre tivemos disponíveis para superar qualquer modelo”. Enquanto isso, Mythos 5 teve um lançamento muito limitado como parte do Projeto Glasswing.
Brian Mercator em Sangue na Máquina Ele descreveu da seguinte forma:
Depois de um grande ciclo de notícias na mídia tecnológica com o anúncio em abril de que havia construído um modelo de IA, o Mythos, que era tão poderoso, tão perigoso que destruiria toda a ordem civilizacional – e impedindo cuidadosamente o governo de fazer isso para nos proteger dele – a startup de IA número 1 do país decidiu impor o Mythos. à venda, no entanto.
Horas depois de Mercator ter escrito essas palavras, a directiva de exportação antropogénica foi proferida e Fable 5 e Mythos 5 tornaram-se inacessíveis por aparentes razões de segurança nacional. Parece que o antrópico só recebeu ordem de revogar o acesso para usuários que não sejam cidadãos dos EUA, mas é compreensível que o antrópico seria inexequível se alguém no mundo o acessasse por medo de desobedecer à ordem. Entre muitas questões, os cidadãos não americanos estão enfrentando dificuldades. Obviamente, é mais simples arrastar os modelos até que a situação seja resolvida.
Curiosamente, a opinião da Anthropic sobre o poder da directiva de exportação observou que a Anthropic “trabalhou com o governo dos EUA”, juntamente com o governo do Reino Unido, e “múltiplas organizações privadas terceiras” num esforço para criar protecções suficientemente fiáveis para os modelos. Os guardas divulgaram, em muitos aspectos, a característica mais proeminente da mídia em torno de Fable 5. Um dos guardas mais severos projetados para punir silenciosamente os usuários que abusaram do modelo, mesmo que fossem considerados mal concebidos, eles alertaram o anthropic para pedir desculpas.
Mas, segundo a Anthropic, o governo está entusiasmado depois de saber das 5 histórias de encarceramento que contornaram todas as salvaguardas importantes:
“É nosso entendimento que o governo acredita que tem uma maneira de contornar, ou ‘jailbreak’, Fable 5. Revisamos uma demonstração desta técnica específica sendo usada para identificar um pequeno número de vulnerabilidades menores previamente conhecidas, todas as quais parecem ser vulnerabilidades relativamente simples, e descobrimos que outros exemplos disponíveis publicamente também podem encontrá-las sem a necessidade de um desvio.
Notas antotrópicas, Fábula 5 está correta. seção em sua postagem no blog A segurança do modelo indicava que alguns vínculos ainda poderiam ser feitos. Provavelmente é impossível de forma alguma Proibimos as prisões universais, mas o objetivo é tornar algumas das prisões restantes bastante lentas e caras, o que podemos detectar e prevenir antes que sejam utilizadas em grande escala, escreveu o antropólogo. Essencialmente, uma vez que um modelo perfeitamente à prova de prisão ainda não é possível, as tentativas antrópicas de produzir títulos que sejam demasiado caros ou demasiado “estreitos” ameaçam. Ele retém os dados do usuário de modelos do tipo Mythos muito mais do que o normal.
No entanto, é estranho ver a Anthropic agora minimizando a importância dos seus modelos de risco percebidos, escrevendo que essas vulnerabilidades são “menores”, “previamente conhecidas” e “relativamente simples”, e também apontando que “outros modelos disponíveis publicamente podem ser encontrados sem exigir quaisquer substituições”.
Mais uma vez, quando a Anthropica lançou pela primeira vez este tipo de modelo, disse ao mundo que tinha criado algo com um poder sem precedentes e com potencial para causar danos reais ao mundo. Dois meses depois, o modelo “classe Mythos” foi produzido para consumo público, disponível como produto premium para usuários dos “planos empresariais Pro, Max, Team e por assento sem custo extra”, mas apenas por tempo limitado. Em 23 de junho, a Anthropic pretendia “remover o Story V desses planos” e exigir um plano pré-pago.
A Anthropica afirma que ações governamentais desse tipo tornam-se, se as regras forem feitas, “sentar tudo para implantar um novo modelo a todos os provedores do modelo limite”. E talvez isso seja verdade. O lançamento de um produto pode ser interrompido quando o lançamento desse produto envolve uma tecnologia pioneira que mereceu o escrutínio global da segurança cibernética, pelo que a reacção exagerada às falhas nas protecções desse produto provavelmente não deveria ser uma surpresa, mesmo que essa reacção exagerada seja má para os negócios.



