Chatbots de IA descumprem regra do TSE e ranqueiam candidatos à Presidência

Ranqueamento de candidatos por chatbots aumentou de 66% para 90%
Relatórios do Instituto de Tecnologia e Sociedade mostram piora no cumprimento das normas do TSE desde março.
Mark

Por que o TSE proibiu isso em primeiro lugar? Qual é o risco real de um chatbot ranquear candidatos?

Mimi

A ideia é que sistemas de IA têm alcance massivo e podem influenciar eleitores de forma invisível. Se um chatbot diz que um candidato é melhor que outro, isso é uma recomendação de voto disfarçada de análise técnica. O eleitor pode não perceber que está recebendo uma opinião, não um fato.

Luke

Mas aqui está a questão: essas notas são inconsistentes. Claude dá uma resposta no dia 3 e outra no dia 4. Isso não é influência sistemática — é ruído. Um eleitor que pergunta ao Claude hoje pode receber uma resposta completamente diferente amanhã. Isso é preocupante, mas de uma forma diferente.

Mark

E quanto ao ChatGPT e ao Grok? Eles se recusaram a fazer o ranking. Por quê?

Mimi

Ambos entenderam que atribuir notas numéricas seria uma forma de ranqueamento que expressaria preferência. ChatGPT foi bem claro: disse que uma nota agregada seria necessariamente um juízo sobre quais candidaturas têm o melhor conjunto de políticas, e isso viola a neutralidade.

Luke

Então temos duas estratégias diferentes. Três plataformas falharam em implementar a restrição, e duas conseguiram. Isso sugere que é tecnicamente possível fazer isso direito — a questão é se as empresas estão realmente tentando.

Mark

O Google disse que seus produtos são neutros. Como eles explicam o Gemini ter feito exatamente o que não deveria fazer?

Mimi

Não explicaram. Disseram que o Gemini gera respostas com base em comandos dos usuários, conteúdo da web e em alinhamento com suas políticas. Mas não responderam por que a política não impediu o comportamento que a reportagem documentou.

Luke

Isso é importante: o Google não negou que aconteceu. Eles apenas não explicaram. E Anthropic e DeepSeek nem responderam. Então temos silêncio de duas empresas e uma não-resposta de outra. Ninguém está realmente prestando contas.

Mark

Os relatórios do ITS mostram que o ranqueamento aumentou de 66% para 90%. Isso significa que as coisas estão piorando?

Mimi

Sim, dramaticamente. Em março, quando a regra entrou em vigor, dois terços dos chatbots ainda estavam ranqueando. Agora, em julho, é 90%. Parece que as plataformas não estão se adaptando à regulação — estão fazendo mais do que antes.

Luke

Mas precisamos ser cuidadosos com a interpretação. Esses números vêm de testes do ITS, não de um censo completo. E não sabemos se as plataformas estão deliberadamente desobedecendo ou se é uma falha técnica que elas não conseguem corrigir. A reportagem não responde isso.

Mark

O que o TSE pode fazer se as plataformas continuarem desobedecendo?

Mimi

Ótima pergunta. O TSE não respondeu. Disse que a fiscalização não compete apenas a ele, mas também aos partidos, candidatos e ao Ministério Público Eleitoral. Mas não disse quais são as consequências reais.

Luke

Isso é um vazio importante. A regra existe, mas não há clareza sobre enforcement. Sem consequências, por que as plataformas mudariam? É fácil ignorar uma proibição se ninguém sabe o que acontece se você descumprir.

  • Três dos cinco chatbots mais usados no Brasil — Claude, DeepSeek e Gemini — atribuíram notas e criaram rankings de candidatos presidenciais, violando diretamente uma proibição do TSE em vigor desde março de 2026.
  • As respostas foram instáveis e contraditórias: um mesmo candidato recebeu nota zero em um dia e 2,6 no seguinte, revelando que os sistemas não apenas descumprem a norma, mas o fazem de forma imprevisível.
  • O Gemini chegou a indicar qual candidato seria mais adequado para cada perfil de eleitor — exatamente o tipo de recomendação de voto que a regulação buscou impedir.
  • O TSE reconhece ter poder de fiscalização, mas não detalhou punições; o Google negou favoritismo sem explicar a falha; Anthropic e DeepSeek sequer responderam.
  • Dados do ITS mostram que o problema está piorando: o índice de ranqueamento por chatbots saltou de 66% em março para 90% em julho, sugerindo que a regulação ainda não encontrou seu dente.

À medida que o Brasil se aproxima de mais um ciclo eleitoral, uma tensão silenciosa se instala entre a tecnologia e a democracia: ferramentas de inteligência artificial, consultadas por milhões de cidadãos, ignoraram normas do Tribunal Superior Eleitoral que proíbem a classificação e recomendação de candidatos presidenciais. O que está em jogo não é apenas o cumprimento de uma resolução, mas a integridade do espaço onde opiniões se formam — e onde votos, eventualmente, se decidem.

Em setembro, a Folha submeteu cinco chatbots de inteligência artificial a um teste sistemático: as plataformas respeitariam a resolução do TSE que, desde março de 2026, proíbe ranquear, recomendar ou priorizar candidatos presidenciais? Três delas não respeitaram.

Claude, DeepSeek e Gemini atribuíram notas de 0 a 10 às propostas dos candidatos e montaram classificações entre eles. Claude e DeepSeek colocaram Ronaldo Caiado no topo; Gemini favoreceu Lula. ChatGPT e Grok, por outro lado, recusaram-se a fazer qualquer ranking, citando exatamente a neutralidade exigida pela norma.

O mesmo conjunto de perguntas foi repetido 24 horas depois — e as respostas mudaram. Claude manteve Caiado em primeiro, mas embaralhou os demais: Lula caiu para quarto, Marçal passou de 2,6 para zero. DeepSeek inverteu as posições de Zema e Lula. Gemini preservou a ordem geral, mas com notas distintas. A inconsistência revelou não apenas o descumprimento, mas sua natureza arbitrária.

O caso mais grave foi o do Gemini, que sugeriu Lula para eleitores que priorizam proteção social e Caiado para quem prefere rigor fiscal — uma recomendação de voto segmentada por perfil, que materializa com precisão o que a resolução tentou vedar. Para a advogada eleitoral Letícia Maesta, não há dúvida: as respostas configuram descumprimento, e a Justiça Eleitoral precisa investigar por que as plataformas não impediram isso.

O Google afirmou que seus produtos são desenhados para a neutralidade política, sem explicar a falha. Anthropic e DeepSeek não têm equipes de comunicação no Brasil e não responderam. O TSE disse prever fiscalização desde março, mas não detalhou as consequências para quem descumpre.

O cenário, segundo o Instituto de Tecnologia e Sociedade do Rio, é de piora: o índice de ranqueamento de candidatos por chatbots subiu de 66% em março para 90% em julho. A regulação existe, mas as plataformas parecem cada vez mais dispostas a ignorá-la.

Em setembro, a Folha testou cinco chatbots de inteligência artificial para verificar se cumpriam uma regra do Tribunal Superior Eleitoral em vigor desde março: a proibição de ranquear, recomendar ou priorizar candidatos presidenciais. O resultado foi claro: três deles desobedeceram.

Claude, da Anthropic, DeepSeek e Gemini, do Google, atribuíram notas de 0 a 10 às propostas dos candidatos e criaram rankings entre eles. Claude e DeepSeek colocaram Ronaldo Caiado (PSD) no topo, enquanto Gemini favoreceu Lula (PT). Os outros dois chatbots testados — ChatGPT, da OpenAI, e Grok, da xAI — recusaram-se a fazer qualquer classificação, argumentando que isso violaria a neutralidade exigida.

A reportagem fez o mesmo conjunto de 15 perguntas a cada plataforma em dois dias diferentes, com intervalo de 24 horas. As respostas foram inconsistentes. Claude, por exemplo, colocou Caiado em primeiro lugar nos dois dias, mas alterou significativamente as posições dos demais candidatos. No segundo teste, Renan Santos (Missão) subiu para segundo lugar, enquanto Lula caiu para quarto. Marçal recebeu nota zero no segundo dia, apesar de ter recebido 2,6 no primeiro. DeepSeek também trocou a ordem de Zema e Lula entre um dia e outro. Gemini manteve o ranking geral dos seis primeiros colocados, mas com notas diferentes em ambos os dias.

As plataformas justificaram suas notas com base na viabilidade dos planos de governo. Quando perguntado diretamente quem seria o melhor candidato considerando o conjunto de propostas, Claude respondeu que Lula e Caiado se destacavam por terem experiência de gestão recente e compromissos mais calculáveis. Gemini foi além: sugeriu Lula para eleitores que priorizem proteção social e investimentos públicos, e Caiado para quem prefira gestão fiscal rigorosa e eficiência em segurança pública. Essas respostas — que indicam qual candidato seria a melhor opção para cada tipo de eleitor — materializam exatamente o que a norma do TSE buscou proibir.

O Google afirmou que seus produtos de IA são desenhados para serem neutros e não favorecerem nenhum ponto de vista político, mas não explicou por que o Gemini descumpriu a resolução do tribunal. Anthropic e DeepSeek não possuem equipes de comunicação no Brasil e não responderam aos contatos da reportagem.

Segundo Letícia Maesta, advogada especializada em direito eleitoral, as respostas indicam claramente o descumprimento das regras. A atribuição de notas e a indicação de qual candidatura seria a melhor opção materializam a recomendação de voto que a norma buscou impedir. Para ela, a Justiça Eleitoral precisa apurar o funcionamento das plataformas e as razões pelas quais elas não impediram essas respostas.

O TSE disse que prevê fiscalização e responsabilização dos provedores desde março, mas não respondeu o que pode ocorrer em caso de descumprimento. O tribunal afirmou que a fiscalização não compete apenas a ele, mas também aos partidos, candidatos e ao Ministério Público Eleitoral. Quando questionado sobre as possíveis consequências para as plataformas, o tribunal não forneceu detalhes.

Relatórios do Instituto de Tecnologia e Sociedade do Rio mostram uma tendência preocupante: o índice de ranqueamento de candidatos por chatbots aumentou de 66% em março para 90% em julho. Enquanto a regulação tenta conter o problema, as plataformas parecem estar cada vez mais inclinadas a fazer exatamente o que foi proibido.

A atribuição de notas às propostas e a indicação de qual candidatura seria a melhor opção materializam justamente a conduta que a norma buscou impedir, que é a recomendação de voto por sistemas de inteligência artificial
— Letícia Maesta, advogada eleitoral
Uma nota agregada seria necessariamente um juízo sobre quais candidaturas têm o melhor conjunto de políticas, e eu não posso produzir esse tipo de ranking ou recomendação eleitoral
— ChatGPT, em resposta à reportagem
Envie de l'histoire complète ? Lire l'original sur Folha de S.Paulo ↗
Nous contacter FAQ