SCORES GERADOS POR IA A PARTIR DE FONTES PÚBLICAS · SEMPRE VERIFIQUE A EVIDÊNCIA

Metodologia do Termômetro - Tô na Dúvida

Este documento define como medimos coerência. Ele é público e faz parte do site (/metodologia). Se a metodologia não convence quem discorda do resultado, ela falhou - então o objetivo aqui é ser transparente, rastreável e igual para todos os candidatos.

Versão: 1.0

1. O que "coerência" significa aqui (e o que não significa)

Coerência = alinhamento entre o que o candidato promete no plano de governo de 2026 e o que sua trajetória mostra que ele efetivamente fez ou defendeu.

O termômetro não mede se a promessa é boa, se a ideologia é certa, ou se a pessoa é honesta. Mede uma coisa só: o discurso de hoje bate com o histórico? Um candidato pode ter um plano ótimo e coerência baixa (mudou de posição), ou um plano que você odeia e coerência alta (sempre agiu assim). Deixar isso explícito no site é essencial para não parecer julgamento de mérito.

2. Fontes de verdade

  • Promessa → sempre do PDF oficial da proposta de governo registrada no TSE. Nunca de entrevista, rede social ou terceiros.
  • Evidência do que foi feito → fonte primária oficial, com URL:
    • Legislativo: votos nominais e proposições de autoria (APIs Câmara/Senado).
    • Executivo: atos, leis sancionadas/vetadas, programas com registro oficial.
    • Declarações só entram quando há registro verificável e são marcadas como tipo declaracao (peso menor que voto/ato - ver §6).

Regra de ouro: toda afirmação exibida tem uma fonteUrl clicável. Sem fonte, a afirmação não existe no site.

3. Passo a passo do pipeline

Passo A - Extrair promessas do plano

O Claude recebe o texto do PDF e devolve uma lista estruturada de promessas, cada uma classificada em um eixo temático fixo (§4) e reescrita como uma afirmação verificável ("pretende fazer X"), com a página de origem.

Passo B - Reunir evidências

Para cada eixo, o pipeline coleta a trajetória relevante do candidato:

  • votos naquele tema (filtrando votações por palavras-chave + uma lista curada de votações-chave por eixo, versionada no repo);
  • proposições de autoria;
  • atos de Executivo, quando aplicável.

Passo C - Pontuar (o Claude julga o alinhamento)

Para cada eixo, o Claude compara promessa × evidências e devolve:

  • um rótulo: coerente, parcial, incoerente ou sem-evidencia;
  • um score 0–100 (§6);
  • uma confiança (alta/media/baixa);
  • uma justificativa curta que cita explicitamente as evidências usadas.

O prompt de pontuação (versionado em pipeline/prompts/) obriga o modelo a:

  1. usar apenas as evidências fornecidas - proibido "lembrar" fatos de fora;
  2. responder sem-evidencia quando os dados não sustentam conclusão - nunca chutar;
  3. citar a fonte de cada evidência que embasa a nota;
  4. tratar todos os candidatos com o mesmo critério (o prompt é idêntico para todos; só mudam os dados).

Passo C2 - Fallback declaratório

Quando ainda não há voto nominal, autoria, ato de governo ou orientação partidária suficiente para um eixo, o site pode usar declarações públicas e cobertura de campanha como evidência de baixa confiança. Esse fallback existe para evitar páginas sem score durante a campanha, mas não vale o mesmo que trajetória oficial: ele mede consistência do discurso público disponível, não execução de promessa.

Passo D - Dimensão partidária

Independente da nota do candidato, o pipeline avalia o partido: para cada votação-chave por eixo, compara a bandeira do candidato (do plano) com a orientação de bancada do partido. Quando não há orientação formal registrada para a sigla naquela votação, usa como fallback a maioria dos votos nominais da bancada na mesma votação. Resultado: "o candidato defende X; o partido dele orientou ou votou contra X em N de M votações-chave", sempre com link.

4. Eixos temáticos (fixos)

Para permitir comparação justa entre candidatos, os eixos são fixos:

  1. Economia e trabalho
  2. Saúde
  3. Educação
  4. Segurança pública
  5. Meio ambiente e clima
  6. Direitos e políticas sociais
  7. Instituições, gestão e combate à corrupção
  8. Política externa

Promessas que não caem em nenhum eixo vão para "Outros" (não pontuado no termômetro geral, mas exibido).

5. Como a trajetória muda o método

O termômetro se adapta ao tipo de trajetória (trajetoria no schema):

  • Legislativo (deputado/senador): base principal são votos e autorias. Método mais robusto.
  • Executivo (governador/prefeito/ministro): base são atos, leis e programas. Não há "voto"; o alinhamento olha realizações documentadas.
  • Misto: usa ambos.
  • Estreante (sem cargo público relevante): frequentemente depende de declarações públicas e cobertura de campanha. Isso é exibido com confiança baixa, porque ausência de trajetória oficial não deve ser tratada como prova de incoerência.

Essa distinção é publicada para o usuário, para que ninguém compare "maçã com laranja" sem saber.

6. Cálculo do score

Por eixo (0–100): o Claude atribui a partir do balanço de evidências a favor e contra a promessa, ponderando o tipo de evidência:

  • voto nominal / ato oficial → peso alto;
  • proposição de autoria → peso médio;
  • declaração pública registrada → peso baixo.

Faixas de rótulo: incoerente 0–39 · parcial 40–69 · coerente 70–100 · sem-evidencia (fora da escala). Quando o eixo é coberto apenas por declaração pública/cobertura de campanha, o score é provisório e a confiança fica baixa.

Geral do candidato: média dos eixos que têm evidência, ponderada pelo número de promessas do candidato naquele eixo (um eixo onde ele fez muitas promessas pesa mais). Eixos sem-evidencia não entram no denominador. Eixos baseados só em declaração pública entram, mas sempre com confianca: baixa e justificativa explícita. O site sempre mostra quantos eixos embasaram a nota geral (ex.: "coerência 72 - baseada em 5 de 8 eixos"), para a média não esconder buracos.

Partido (0–100): proporção de votações-chave em que a orientação do partido foi no mesmo sentido da bandeira do candidato. Se não houver orientação formal, o pipeline pode usar a maioria dos votos nominais da bancada como sinal secundário, identificado dessa forma na fonte exibida.

Nenhum número é apresentado sozinho. O score é a porta de entrada; abaixo dele ficam sempre os eixos, as evidências e os links. A conclusão é do usuário.

7. Salvaguardas do modo automático

O termômetro é gerado automaticamente pelo Claude (sem revisão humana obrigatória no MVP). Isso é rápido e escalável, mas exige travas para não virar alvo fácil de acusação de viés. São requisitos de implementação, não opcionais:

  1. Rastreabilidade total: todo score carrega modelo, versaoMetodologia, geradoEm e as fonteUrl de cada evidência.
  2. Reprodutibilidade: temperatura baixa/zero e prompt fixado; mesma entrada reproduz a saída. Prompts versionados no Git.
  3. Separar trajetória de declaração: quando a evidência é só fala pública, a nota é permitida apenas como fallback declaratório de baixa confiança; voto, autoria e ato oficial continuam tendo peso superior.
  4. Rótulo honesto de origem: o site declara, de forma visível, que os scores são gerados por IA a partir de fontes públicas, com data e link para a metodologia.
  5. Confiança exposta: cada eixo mostra alta/media/baixa; confiança baixa vem com aviso visual.
  6. Igualdade de tratamento: o mesmo prompt e o mesmo conjunto de votações-chave por eixo valem para todos os candidatos.
  7. Auditável e contestável: dados versionados no Git; qualquer pessoa pode abrir um PR/issue apontando erro numa evidência ou score.
  8. Canal de correção: o site tem um caminho claro para reportar erro factual.

Recomendação (fora do MVP, mas barata): um spot-check humano de uma amostra dos eixos antes de cada publicação. Não muda a arquitetura - é só olhar o diff do /data. Fica registrado aqui como o próximo degrau de robustez.

8. Limitações que o site assume publicamente

  • Coerência ≠ qualidade da proposta nem honestidade.
  • Ausência de voto/ato oficial pode virar score declaratório de baixa confiança, mas não deve ser lida como prova forte de coerência.
  • Trajetórias de Executivo são mais difíceis de quantificar que as de Legislativo.
  • A leitura de "alinhamento" tem uma camada interpretativa; por isso mostramos a evidência crua para o usuário decidir.
  • A curadoria das votações-chave é uma escolha editorial - por isso ela é pública e versionada, aberta a contestação.

9. Versionamento da metodologia

Mudou o cálculo, os pesos ou a lista de votações-chave? Sobe a versaoMetodologia e registra no CHANGELOG. Scores antigos guardam a versão com que foram gerados, para comparações no tempo continuarem honestas.