Twitch atualizado As configurações da conta da empresa controladora do Twitch, Amazon, para evitar que streamers usem seu conteúdo para treinar modelos de inteligência artificial.
Embora a mudança seja tranquilizadora para alguns criadores, não está claro quando a plataforma de streaming começou a usar postagens, streams e vídeos de seus usuários para treinar os sistemas da Amazon. A revelação levanta novas preocupações sobre como as grandes empresas de tecnologia lidam com os dados dos seus utilizadores.
O processo de retirada é fácil. No site Twitch ou aplicativo móvel, clique e selecione o avatar da sua conta configurações, Então siga em frente Segurança e privacidade seção no menu. Lá você encontrará Treinamento de IA generativa Opcionalmente, você pode desabilitar o uso do seu conteúdo para essa finalidade.
Na linguagem próxima à transição, Twitch observa que “desativar esta opção não impedirá que Twitch e Amazon usem o conteúdo do seu canal para outros fins descritos no aviso de privacidade do Twitch”. Isso inclui recursos de plataforma alimentados por IA projetados para facilitar o crescimento e a monetização de streamers, como assistência em tempo real com campanhas de patrocínio, descoberta de público por meio de referências e proteção social por meio de ferramentas como o AutoMod.
O novo sistema reconhece o direito dos criadores de decidir como o conteúdo que criam é utilizado. No entanto, seu lançamento também levantou questões sobre como o Twitch e a Amazon usaram esse conteúdo até agora.
Em um fórum dedicado ao tema, mais de 16.000 criadores expressaram oposição ao uso padrão de seu conteúdo para treinar os sistemas de IA da Amazon – uma medida que veio à tona após uma atualização dos sistemas.
A reação surgiu depois que a chefe da comunidade do Twitch, Mary Kish, entrou ao vivo para explicar a introdução das mudanças. O executivo reconheceu que a mudança provocaria uma reação negativa. No que ele descreveu como “uma resposta honesta”, o chefe de produto do Twitch, Mike Minton, observou que a opção de usar conteúdo para treinamento de IA deve ser ativada por padrão, caso contrário “ninguém participaria” do processo.
Minton destacou que esses algoritmos não são exclusivos do Twitch e presumiu que outras empresas que constroem sistemas de IA também extraem conteúdo do Twitch e de outros serviços para treinar seus modelos. “Não tenho certeza”, disse ele, “mas acho bastante razoável supor que qualquer conteúdo disponível publicamente possa ser usado para treinar modelos de alguma forma, com ou sem permissão. Portanto, acho que temos que reconhecer que há muitas coisas aqui que estão além do nosso controle direto.”
Esses relatórios levantaram novas questões: desde quando o conteúdo do Twitch tem sido usado para treinar modelos de IA? A Amazon é a única empresa que utiliza esses dados ou seus parceiros comerciais também estão envolvidos? Até que ponto e de que forma são respeitados os direitos autorais dos conteúdos publicados pelos criadores?
Os Termos de Serviço da Twitch, em vigor em março de 2024, concedem aos usuários o direito de usar, reproduzir, modificar, adaptar, distribuir e criar trabalhos derivados de seu conteúdo para a Twitch e seus sublicenciados. No entanto, até agora, eles não declararam explicitamente que tais materiais podem ser usados para treinar modelos generativos de IA.
Problema de dados de treinamento
O caso destaca um dos principais desafios enfrentados pelos desenvolvedores de sistemas de IA: a crescente falta de dados de alta qualidade para modelos de treinamento.
Embora organizações como a OpenAI tenham chegado a acordos com vários editores (incluindo a empresa-mãe da WIRED, Condé Nast) para utilizar parte do seu conteúdo para este fim, as fontes de dados disponíveis estão a diminuir à medida que a tecnologia avança e a procura por dados aumenta. Como resultado, surgiram diversas alternativas que reacendem o debate sobre a ética e a transparência dos processos formativos.


