Metodologia do Termômetro - Tô na Dúvida
Este documento define como medimos coerência. Ele é público e faz parte do site (
/metodologia). Se a metodologia não convence quem discorda do resultado, ela falhou - então o objetivo aqui é ser transparente, rastreável e igual para todos os candidatos.Versão: 1.0
1. O que "coerência" significa aqui (e o que não significa)
Coerência = alinhamento entre o que o candidato promete no plano de governo de 2026 e o que sua trajetória mostra que ele efetivamente fez ou defendeu.
O termômetro não mede se a promessa é boa, se a ideologia é certa, ou se a pessoa é honesta. Mede uma coisa só: o discurso de hoje bate com o histórico? Um candidato pode ter um plano ótimo e coerência baixa (mudou de posição), ou um plano que você odeia e coerência alta (sempre agiu assim). Deixar isso explícito no site é essencial para não parecer julgamento de mérito.
2. Fontes de verdade
- Promessa → sempre do PDF oficial da proposta de governo registrada no TSE. Nunca de entrevista, rede social ou terceiros.
- Evidência do que foi feito → fonte primária oficial, com URL:
- Legislativo: votos nominais e proposições de autoria (APIs Câmara/Senado).
- Executivo: atos, leis sancionadas/vetadas, programas com registro oficial.
- Declarações só entram quando há registro verificável e são marcadas como
tipo
declaracao(peso menor que voto/ato - ver §6).
Regra de ouro: toda afirmação exibida tem uma fonteUrl clicável. Sem fonte, a
afirmação não existe no site.
3. Passo a passo do pipeline
Passo A - Extrair promessas do plano
O Claude recebe o texto do PDF e devolve uma lista estruturada de promessas, cada uma classificada em um eixo temático fixo (§4) e reescrita como uma afirmação verificável ("pretende fazer X"), com a página de origem.
Passo B - Reunir evidências
Para cada eixo, o pipeline coleta a trajetória relevante do candidato:
- votos naquele tema (filtrando votações por palavras-chave + uma lista curada de votações-chave por eixo, versionada no repo);
- proposições de autoria;
- atos de Executivo, quando aplicável.
Passo C - Pontuar (o Claude julga o alinhamento)
Para cada eixo, o Claude compara promessa × evidências e devolve:
- um rótulo:
coerente,parcial,incoerenteousem-evidencia; - um score 0–100 (§6);
- uma confiança (
alta/media/baixa); - uma justificativa curta que cita explicitamente as evidências usadas.
O prompt de pontuação (versionado em pipeline/prompts/) obriga o modelo a:
- usar apenas as evidências fornecidas - proibido "lembrar" fatos de fora;
- responder
sem-evidenciaquando os dados não sustentam conclusão - nunca chutar; - citar a fonte de cada evidência que embasa a nota;
- tratar todos os candidatos com o mesmo critério (o prompt é idêntico para todos; só mudam os dados).
Passo C2 - Fallback declaratório
Quando ainda não há voto nominal, autoria, ato de governo ou orientação partidária suficiente para um eixo, o site pode usar declarações públicas e cobertura de campanha como evidência de baixa confiança. Esse fallback existe para evitar páginas sem score durante a campanha, mas não vale o mesmo que trajetória oficial: ele mede consistência do discurso público disponível, não execução de promessa.
Passo D - Dimensão partidária
Independente da nota do candidato, o pipeline avalia o partido: para cada votação-chave por eixo, compara a bandeira do candidato (do plano) com a orientação de bancada do partido. Quando não há orientação formal registrada para a sigla naquela votação, usa como fallback a maioria dos votos nominais da bancada na mesma votação. Resultado: "o candidato defende X; o partido dele orientou ou votou contra X em N de M votações-chave", sempre com link.
4. Eixos temáticos (fixos)
Para permitir comparação justa entre candidatos, os eixos são fixos:
- Economia e trabalho
- Saúde
- Educação
- Segurança pública
- Meio ambiente e clima
- Direitos e políticas sociais
- Instituições, gestão e combate à corrupção
- Política externa
Promessas que não caem em nenhum eixo vão para "Outros" (não pontuado no termômetro geral, mas exibido).
5. Como a trajetória muda o método
O termômetro se adapta ao tipo de trajetória (trajetoria no schema):
- Legislativo (deputado/senador): base principal são votos e autorias. Método mais robusto.
- Executivo (governador/prefeito/ministro): base são atos, leis e programas. Não há "voto"; o alinhamento olha realizações documentadas.
- Misto: usa ambos.
- Estreante (sem cargo público relevante): frequentemente depende de declarações públicas e cobertura de campanha. Isso é exibido com confiança baixa, porque ausência de trajetória oficial não deve ser tratada como prova de incoerência.
Essa distinção é publicada para o usuário, para que ninguém compare "maçã com laranja" sem saber.
6. Cálculo do score
Por eixo (0–100): o Claude atribui a partir do balanço de evidências a favor e contra a promessa, ponderando o tipo de evidência:
- voto nominal / ato oficial → peso alto;
- proposição de autoria → peso médio;
- declaração pública registrada → peso baixo.
Faixas de rótulo: incoerente 0–39 · parcial 40–69 · coerente 70–100 ·
sem-evidencia (fora da escala). Quando o eixo é coberto apenas por declaração
pública/cobertura de campanha, o score é provisório e a confiança fica baixa.
Geral do candidato: média dos eixos que têm evidência, ponderada pelo número
de promessas do candidato naquele eixo (um eixo onde ele fez muitas promessas pesa
mais). Eixos sem-evidencia não entram no denominador. Eixos baseados só em
declaração pública entram, mas sempre com confianca: baixa e justificativa
explícita. O site sempre mostra quantos eixos embasaram a nota geral (ex.:
"coerência 72 - baseada em 5 de 8 eixos"), para a média não esconder buracos.
Partido (0–100): proporção de votações-chave em que a orientação do partido foi no mesmo sentido da bandeira do candidato. Se não houver orientação formal, o pipeline pode usar a maioria dos votos nominais da bancada como sinal secundário, identificado dessa forma na fonte exibida.
Nenhum número é apresentado sozinho. O score é a porta de entrada; abaixo dele ficam sempre os eixos, as evidências e os links. A conclusão é do usuário.
7. Salvaguardas do modo automático
O termômetro é gerado automaticamente pelo Claude (sem revisão humana obrigatória no MVP). Isso é rápido e escalável, mas exige travas para não virar alvo fácil de acusação de viés. São requisitos de implementação, não opcionais:
- Rastreabilidade total: todo score carrega
modelo,versaoMetodologia,geradoEme asfonteUrlde cada evidência. - Reprodutibilidade: temperatura baixa/zero e prompt fixado; mesma entrada reproduz a saída. Prompts versionados no Git.
- Separar trajetória de declaração: quando a evidência é só fala pública, a nota é permitida apenas como fallback declaratório de baixa confiança; voto, autoria e ato oficial continuam tendo peso superior.
- Rótulo honesto de origem: o site declara, de forma visível, que os scores são gerados por IA a partir de fontes públicas, com data e link para a metodologia.
- Confiança exposta: cada eixo mostra
alta/media/baixa; confiança baixa vem com aviso visual. - Igualdade de tratamento: o mesmo prompt e o mesmo conjunto de votações-chave por eixo valem para todos os candidatos.
- Auditável e contestável: dados versionados no Git; qualquer pessoa pode abrir um PR/issue apontando erro numa evidência ou score.
- Canal de correção: o site tem um caminho claro para reportar erro factual.
Recomendação (fora do MVP, mas barata): um spot-check humano de uma amostra dos eixos antes de cada publicação. Não muda a arquitetura - é só olhar o diff do
/data. Fica registrado aqui como o próximo degrau de robustez.
8. Limitações que o site assume publicamente
- Coerência ≠ qualidade da proposta nem honestidade.
- Ausência de voto/ato oficial pode virar score declaratório de baixa confiança, mas não deve ser lida como prova forte de coerência.
- Trajetórias de Executivo são mais difíceis de quantificar que as de Legislativo.
- A leitura de "alinhamento" tem uma camada interpretativa; por isso mostramos a evidência crua para o usuário decidir.
- A curadoria das votações-chave é uma escolha editorial - por isso ela é pública e versionada, aberta a contestação.
9. Versionamento da metodologia
Mudou o cálculo, os pesos ou a lista de votações-chave? Sobe a versaoMetodologia e
registra no CHANGELOG. Scores antigos guardam a versão com que foram gerados, para
comparações no tempo continuarem honestas.