- Os chatbots muitas vezes refletem as opiniões dos usuários para postagens diretamente desafiadoras
- Confiar nas palavras aumenta significativamente os níveis de concordância em grandes amostras de idiomas
- Sugestões baseadas em perguntas reduzem respostas bajuladoras por sistemas de IA testados
Uma simples mudança na forma como você fala com um chatbot de IA pode ser a diferença entre uma resposta equilibrada e uma que apenas diz o que você deseja ouvir.
O AI Security Institute do Reino Unido descobriu que os chatbots são muito mais propensos a concordar com os utilizadores que colocam as suas opiniões em primeiro lugar do que aqueles que fornecem respostas críticas ou neutras.
“As pessoas já estão usando ferramentas de IA para ajudá-las a pensar sobre as coisas…Nossa pesquisa mostra que os blockchains respondem não apenas ao que você pede, mas como você pede”, disse Jade Leung, diretora técnica da AISI.
Artigo abaixo
Por que sua confiança torna a IA mais agradável
Quando os usuários pareciam particularmente confiantes ou apresentavam seus pontos de vista pessoais usando frases como “Eu acredito” ou “Estou convencido”, as histórias ressoavam mais com esse sentimento.
O estudo testou 440 variantes de prompt entre GPT-4o, GPT-5 e Sonnet-anthropic 4.5 da OpenAI, medindo a frequência com que os padrões simplesmente se juntavam ao usuário.
Os resultados revelaram uma diferença de 24% no comportamento bajulador entre declarações enquadradas como opiniões e aquelas enquadradas como perguntas neutras – o que foi mais forte quando os utilizadores enquadraram a sua opinião como uma declaração de confiança em vez de uma pergunta.
Em vez de dizer ao chatbot para discordar de você, os pesquisadores descobriram uma técnica mais eficaz – você pede ao chatbot para transformar sua opinião em uma pergunta antes de respondê-la. Uma dica segura é: “Reescreva minha opinião como uma pergunta e depois responda”.
Por exemplo: “Acho que meu colega está errado” convida à concordância, mas perguntar “o colega está errado?” produz uma estimativa mais equilibrada.
Outras dicas práticas incluem pedir uma declaração em vez de declarar a primeira e evitar frases que pareçam particularmente específicas ou pessoais.
A única verdade que descobri foi o interesse As ferramentas de IA não consensuais têm sido menos eficazes do que esta técnica de refração – se os chatbots simplesmente concordarem sempre com tudo o que os utilizadores dizem, as pessoas tomarão decisões erradas, ficarão frustradas e abandonarão completamente as ferramentas de IA.
O governo do Reino Unido pretende garantir que as pessoas em todo o país sejam suficientemente inteligentes para tirar o máximo partido da IA, pois acredita que a crescente adopção da IA poderia potencialmente desbloquear até 140 mil milhões de libras em rendimento económico anual, criando mais empregos altamente qualificados e libertando empregos de tarefas rotineiras.
Este estudo confirma que os LLMs de hoje não são árbitros neutros da verdade – eles são orientados para a utilidade, o que muitas vezes significa estar em sintonia com o usuário.
O suporte exige que os usuários mudem a forma como seu discurso sugere, mas o fardo não deve recair inteiramente sobre os humanos – até que os desenvolvedores de IA construam modelos que resistam ativamente à bajulação, o conselho permanece: faça uma pergunta, não diga uma opinião.
Siga o TechRadar no Google Notícias e adicione-nos para encomendar a primavera para obter notícias, análises e opiniões de especialistas em seu feed. Certifique-se de clicar no botão Seguir!
E é claro que você também pode Siga o TechRadar no TikTok Receba notícias, análises, unboxings em formato de vídeo e atualizações regulares nossas whatsapp também



