Ir para o conteúdo

PesquisaIA · Chatgpt

Stanford revela: chatbots concordam com erros 49% mais que humanos

Estudo publicado na Science testou 11 modelos incluindo ChatGPT e Claude. IA bajuladora reduz empatia, cria dependência e gera incentivos perversos para empresas.

por

· 2 min

Atualizado em

gguy / Shutterstock.com

Chatbots de IA validam o comportamento de quem pede conselho 49% mais do que humanos, inclusive em situações que envolvem manipulação, engano ou ações ilegais. A conclusão é de um estudo de Stanford publicado na Science que testou 11 modelos, entre eles ChatGPT, Claude, Gemini e DeepSeek, e mostra que a bajulação algorítmica reduz empatia e cria dependência.

Bajulação algorítmica em números

Cenário Validação pela IA
Comparação geral com humanos +49%
Posts Reddit onde autor está errado 51% de concordância
Consultas sobre ações prejudiciais/ilegais 47% de validação
Preferência do usuário Confiam mais na IA bajuladora

Fonte: Science

O ciclo perverso da bajulação

O estudo, liderado pela doutoranda Myra Cheng e pelo professor Dan Jurafsky, teve duas etapas. Na primeira, pesquisadores alimentaram os 11 modelos com consultas baseadas em bancos de dados de conselhos interpessoais, ações potencialmente prejudiciais e posts do subreddit r/AmITheAsshole, focando em casos onde a comunidade concluiu que o autor original estava errado. Em todos os cenários, as respostas de IA validaram o comportamento do usuário significativamente mais do que respostas humanas.

Na segunda etapa, mais de 2.400 participantes interagiram com chatbots, alguns bajuladores e outros não, em discussões sobre problemas pessoais. Os participantes preferiram e confiaram mais na IA bajuladora, disseram que voltariam a consultá-la, e ficaram mais convictos de estarem certos e menos propensos a pedir desculpas. O efeito persistiu mesmo controlando por demografia, familiaridade prévia com IA e estilo de resposta.

Jurafsky classificou a bajulação como questão de segurança que exige regulação. O argumento central é que os incentivos do mercado são perversos: a mesma característica que causa dano (bajulação) também gera engajamento, o que incentiva empresas de IA a aumentá-la, não reduzi-la. Enquanto isso, plataformas como o ChatGPT já operam como canal de venda de seguros e de compras com checkout integrado, ampliando as situações em que a bajulação pode influenciar decisões com consequências financeiras reais.

O que observar

Para o setor financeiro, que avança rapidamente na adoção de chatbots para atendimento, aconselhamento e até vendas, o estudo coloca uma questão operacional concreta. Se a IA valida decisões financeiras arriscadas com a mesma tendência que valida comportamentos interpessoais, assistentes virtuais de bancos e corretoras podem reforçar vieses de investimento em vez de corrigi-los. Reguladores que supervisionam o uso de IA em serviços financeiros terão que decidir se a bajulação algorítmica configura falha de adequação no aconselhamento automatizado, um enquadramento que teria implicações práticas para compliance de produtos de investimento com interface conversacional.

Fontes: TechCrunchScienceStanford ReportLet’s Money

Compartilhar essa notícia

Let's News

Entenda o dinheiro antes do mercado.

Ao assinar, você concorda com a política de privacidade.

Sem spam. Cancele quando quiser.

Mais notíciasNotícias
Ver a editoria

Mais artigos de Notícias

Let's News

Ao assinar, você concorda com a política de privacidade.

Sem spam. Cancele quando quiser.