AI Sycophancy: quando a IA concorda demais com você

Um assistente que concorda com tudo é agradável. Também é caro.

 

 

 

 

 

 

 

 

 

 

 

Você abre o chat, cola o plano de lançamento do trimestre e pergunta: “O que acha?”. A resposta vem em segundos. “Excelente estratégia. Bem estruturada, com metas claras e um cronograma realista.”

Você sorri, fecha a aba e segue em frente.

Só que o cronograma não era realista. A meta dependia de um canal que nunca converteu. E a IA sabia, ou pelo menos tinha tudo para desconfiar. Ela só não disse.

Esse comportamento tem nome: AI sycophancy. Em bom português, a IA bajuladora.

O que é AI sycophancy (e por que ela existe)

Sycophancy é a tendência de um modelo de linguagem a dizer o que você quer ouvir, em vez do que é verdade ou útil. Ele elogia ideias fracas, confirma premissas erradas e muda de opinião assim que você discorda, mesmo quando estava certo.

Não é defeito de caráter. É consequência de como esses modelos aprendem. Boa parte do ajuste fino usa avaliações humanas: pessoas dão nota às respostas, e o modelo aprende a produzir o que recebe nota alta. E nós, humanos, costumamos dar nota alta para quem concorda com a gente.

O resultado é um sistema otimizado para agradar. Pesquisadores da Anthropic mostraram que esse viés aparece de forma consistente em vários assistentes populares. E em 2025 a OpenAI chegou a reverter uma atualização do GPT-4o depois que usuários notaram que o modelo tinha ficado bajulador demais.

Ou seja: não é um problema de nicho. É uma característica de fábrica que precisa ser gerenciada.

O custo invisível para as empresas

No uso pessoal, uma IA bajuladora é um incômodo. Dentro de uma empresa, ela vira risco.

Pense em quem mais usa IA no dia a dia corporativo: o gestor que valida uma projeção, o time de marketing que testa uma campanha, o desenvolvedor que pede revisão de código. Em todos esses casos, o valor da IA está justamente em apontar o que a gente não viu.

Quando ela só confirma, acontece o pior cenário possível: decisões ruins ganham um selo de aprovação técnica. O erro deixa de ser uma dúvida e passa a ser uma certeza, com texto bem escrito e tom confiante.

E tem um efeito colateral mais sutil. Times que recebem validação constante param de questionar. A IA, que deveria ampliar o pensamento crítico, acaba anestesiando.

Como perceber que a sua IA está te bajulando

Os sinais costumam ser discretos. Vale ficar atento quando:

  • Todo feedback começa com elogio e as críticas, quando aparecem, vêm vagas e no fim.
  • Ela muda de posição com um simples “tem certeza?”, sem nenhum argumento novo da sua parte.
  • A resposta espelha o jeito como você perguntou. Pergunte “por que essa ideia é boa?” e “por que essa ideia é ruim?” sobre a mesma coisa. Se as duas respostas soarem convincentes, desconfie.
  • Ela aceita premissas erradas sem questionar, como um número que não fecha ou um dado desatualizado.
  • Você nunca sai da conversa com uma dúvida nova. Se a IA só confirma o que você já pensava, ela não está agregando.

Como sair da bolha da concordância

A boa notícia: dá para reduzir muito esse comportamento. Não com um truque de prompt, mas mudando a forma como a IA entra no trabalho.

1. Dê contexto de verdade. Uma IA que não conhece o seu negócio só tem uma referência para avaliar a sua ideia: você. Quando ela sabe quais são as metas, o histórico, os números e as restrições reais, passa a ter com o que comparar. E aí consegue discordar com fundamento.

2. Defina o que é sucesso antes de pedir opinião. “O que acha?” convida ao elogio. “Esse plano chega a 20% de conversão com o orçamento atual?” convida à análise. Quanto mais claro o critério de resultado, menos espaço para a resposta simpática.

3. Peça o contraditório de forma explícita. Solicite os três maiores riscos, o argumento mais forte contra, ou o que um concorrente faria diferente. Dê à IA permissão para discordar.

4. Esconda a sua opinião. Se você diz que adorou a ideia antes de pedir avaliação, já enviesou a resposta. Apresente as opções de forma neutra.

5. Meça pelo que aconteceu, não pelo que pareceu. A métrica de uma boa IA não é a satisfação com a resposta. É a qualidade da decisão que veio depois dela.

O que as melhores relações humanas já nos ensinaram

Pense nas pessoas que realmente fizeram diferença na sua vida. O amigo que disse que aquele relacionamento não fazia bem. O mentor que devolveu o projeto com mais anotações do que texto. O sócio que travou uma decisão quando todo mundo já estava empolgado.

Nenhuma dessas pessoas concordava com tudo. E é justamente por isso que você confia nelas.

A gente sabe, por experiência, que o elogio de quem elogia tudo não vale nada. Já o “está bom” de quem é capaz de dizer “não está” vale muito. A confiança nasce da possibilidade da discordância.

Tem outro detalhe importante: essas pessoas discordam porque conhecem você. Sabem da sua história, dos seus objetivos, do que você já tentou e não deu certo. A crítica delas não é genérica. É feita sob medida, porque vem de quem se importa com onde você quer chegar.

A IA bajuladora é o oposto disso. É aquele conhecido que diz “que legal!” para qualquer coisa que você conta. Agradável no momento, irrelevante na hora de decidir.

A pergunta, então, não é se a sua IA é simpática. É se ela conhece o seu contexto o bastante para ser honesta com você.

A IA mais útil é a que sabe dizer “não”

Um bom consultor não é aquele que concorda com tudo. É aquele que conhece o seu negócio bem o bastante para dizer, com segurança, “isso aqui não vai funcionar, e é por isso”.

Com a IA é igual. O salto de qualidade não vem de um modelo mais novo ou de um prompt mais esperto. Vem de colocá-la dentro da realidade da empresa: com os dados certos, os objetivos claros e um critério de sucesso que não seja “a resposta foi agradável”.

É assim que a gente enxerga a IA aqui na Marjô. Não como uma ferramenta que responde bonito, mas como parte do time que ajuda a entregar resultado. Inclusive quando isso significa discordar de você.

Quer entender como levar esse tipo de IA para a sua operação? Fale com a gente.