Outras empresas de IA também devem colocar marcas d’água no conteúdo.
Imagens de Cheng Jin/Getty
A Anthropic revelou como o texto da marca d’água criado por Claude AI está em conformidade com as novas regras de transparência de IA da UE. A marca d’água do texto da empresa não possui recursos visuais fáceis de ver, não é distinguível pelos leitores e não inclui caracteres ocultos no texto. Em contrapartida, o método antrópico envolve deixar um padrão no texto que só pode ser decodificado por alguém que tenha a chave dele.
A empresa explicou que grandes modelos de linguagem selecionam uma palavra por vez ao gerar texto a partir de uma lista de palavras potencialmente adequadas. Eles escolhem palavras aleatoriamente, desde que façam sentido para o contexto que estão criando. Com a marca d’água ativada, em vez de usar um gerador arbitrário de números aleatórios para escolher a próxima palavra, Claude usará uma chave para decidir qual palavra escolher.
Em seu exemplo, a Anthropic usou os dígitos do Pi como chave. Digamos que a chave comece no dígito 2 da matriz pi 3,1415926535. A sexta palavra é criada na lista de opções, depois a quinta, a terceira e a quinta. Este método é uma adaptação da abordagem SynthID-Text do Google DeepMind Natureza.A empresa disse que a marca d’água não afetará a qualidade do lançamento na nuvem nem o retardará, e não exigirá tokens adicionais nem tornará as gerações mais caras.
É claro que a prosa gerada pela IA geralmente é reveladora. As amostras tendem a usar certas construções de frases, como “não é”. [X]aquilo é [Y]”, por exemplo. Mas essas mensagens são suficientes para dizer que uma IA estava envolvida na escrita daquele texto, não o modelo usado. A Anthropic lançará uma API que possui as “chaves” para decodificar a marca d’água de Claude e dizer se sua IA gerou um bloco de texto verificado.
A Anthropic reconhece que seu método de marca d’água em texto tem limitações. Você não pode dizer se Claude realmente escreveu o texto ou o editou, o que significa que se você pedir à IA para editar algo para você, ele também terá marca d’água. Conforme explica a empresa, só podemos dizer que Claude às vezes se envolve com o texto. Até as traduções terão marca d’água. Se Claude apenas verificou e editou levemente o texto, ou se o texto for muito pequeno, a marca d’água pode não ser suficiente para ser detectada. Observe que editar levemente o texto gerado pelo torrão não removerá a marca d’água. Se quiser ter certeza, você deve reescrevê-lo completamente.
Há alguma preocupação sobre como a marca d’água afetará o código, uma vez que os direitos autorais não podem ser obtidos sem uma contribuição humana significativa. Se alguém puder provar que uma base de código inteira é gerada por IA, poderá copiá-la e repeti-la. A Anthropic disse, no entanto, que o código tem “geralmente menos marcas d’água do que alguns outros tipos de texto” porque geralmente requer saída adequada. Se não houver seleções na criação do texto, a marca d’água não poderá ser usada.
A Antrópica marca imagens com marcas d’água adicionando uma nota assinada criptograficamente aos metadados que Claude afirma ter criado. Em seu anúncio, a empresa disse que aplicará marcas d’água a todas as versões do Cloud Publishing porque não há formas concretas de implementar mudanças com base na região. Essas mudanças afetarão o lançamento de todos os produtos Clad utilizando modelos lançados após 2 de agosto. A Anthropic também adicionará capacidade de marca d’água a modelos Cloud mais antigos nos próximos meses.



