Transparência
Metodologia e fontes
O agregador reúne pesquisas de intenção de voto e calcula, para cada disputa, uma média ponderada móvel — mais estável do que qualquer pesquisa isolada.
O Agregador IPPI apresenta uma estimativa consolidada das pesquisas disponíveis. Não se trata de uma previsão do resultado da eleição nem de uma probabilidade de vitória.
Pesquisas eleitorais representam retratos do período em que foram realizadas. Resultados podem variar conforme metodologia, período de campo, questionário, cenário apresentado e características da amostra.
Critérios para uma pesquisa entrar na média
A expressão “pesquisas que compõem a média atual” considera apenas pesquisas que, na data de referência:
- estão dentro da janela de 75 dias;
- medem o mesmo cenário (mesmo cargo, território, turno e conjunto de candidatos);
- usam intenção total (estimulada bruta), não votos válidos;
- têm data de campo, amostra válida e resultados;
- no Senado, têm escala de divulgação identificada (ver “Senado — duas vagas”);
- não foram excluídas manualmente;
- têm peso final maior que zero.
Cada pesquisa exibe na tabela um selo com sua situação (na média, fora da janela, votos válidos, escala indefinida, cenário diferente ou dados insuficientes). Os contadores separam a série histórica (todas as pesquisas agregáveis) da média atual (apenas as dentro da janela).
Como a média é calculada
Cada pesquisa entra na média de uma semana com um peso que combina dois fatores:
Recência — decai exponencialmente com a distância entre a data de campo e a semana avaliada (meia-vida ~15 dias, janela de 75 dias): exp(−dias / 21).
Tamanho da amostra — pesquisas maiores pesam mais, com retorno decrescente: √(amostra / 1000). A média só é publicada com pelo menos duas pesquisas na janela.
Base de votos — total vs. válidos
Só entram na média pesquisas na mesma base: a intenção total (estimulada bruta), que inclui brancos, nulos e indecisos. Pesquisas divulgadas apenas em votos válidos (que excluem esses eleitores e inflam os percentuais) aparecem na tabela marcadas, mas ficam fora da média. Exemplo real: no Piauí, a mesma pesquisa do Amostragem (jul/2026) deu Fonteles 72,4% em votos válidos e apenas 57,3% na intenção total.
Base oficial do TSE (PesqEle)
A espinha do agregador é a base de dados abertos do TSE: importamos todos os registros de pesquisas de cada disputa (protocolo, instituto, cargo, datas, amostra, estatístico). Por isso cada disputa mostra quantas pesquisas estão registradas no TSE. O dado aberto não traz os percentuais por candidato — por isso a coleta assistida: na área da equipe você escolhe o registro oficial (que preenche instituto, datas, amostra e protocolo) e digita só os números.
Efeito do instituto (leave-one-out)
Para cada instituto, comparamos o que ele mediu com o consenso dos demais institutos na mesma data — nunca com uma média que inclua a própria pesquisa (método leave-one-out). Positivo = mede acima do consenso.
Shrinkage: institutos com poucas pesquisas têm o efeito puxado em direção a zero, porefeito ajustado = efeito bruto × n / (n + 5), evitando conclusões exageradas a partir de um único levantamento.
Confiança: 1 pesquisa = dados insuficientes (sem número); 2 = preliminar; 3–5 = baixa; 6–10 = moderada; mais de 10 = mais alta. O efeito é um indicador analítico — não corrige automaticamente os números publicados.
Intervalo de incerteza
Cada candidato recebe um intervalo de 95% estimado por simulação de Monte Carlo (não é a média simples das margens de erro). A cada simulação, reamostramos as pesquisas conforme seus pesos e perturbamos cada resultado pelo seu erro amostral (função do tamanho da amostra, com variância mínima). Os percentis de 2,5% e 97,5% das milhares de simulações formam o intervalo. Com poucas pesquisas, o intervalo naturalmente fica mais largo.
A partir da sobreposição desses intervalos, o agregado classifica a disputa em liderança consolidada, vantagem provável, disputa competitiva ou empate técnico no agregado — evitando afirmar categoricamente “lidera” quando os intervalos se sobrepõem.
Regra conservadora (v1.4). O intervalo mede a dispersão entre as pesquisas; ele não capta um erro que seja comum a todos os institutos. Por isso, “liderança consolidada” exige, além de intervalos separados, vantagem de pelo menos 6 pontos percentuais. Abaixo disso a disputa é classificada, no máximo, como “vantagem provável”. No Senado, a classificação olha a linha de corte — o 2º colocado contra o 3º —, porque os dois primeiros são eleitos.
Fontes dos percentuais
A hierarquia de fontes é: (1) relatório ou divulgação do próprio instituto e registro no PesqEle/TSE; (2) cadastro da equipe a partir do relatório; (3) compilações públicas. A maior parte do acervo vem hoje do nível 3 — as tabelas da Wikipédia que espelham os registros do TSE, marcadas na tabela como “compilação”:
Extração determinística (v1.4). As tabelas são lidas diretamente do código-fonte da página, célula a célula, com o nome de cada coluna tirado do cabeçalho da própria tabela — sem resumo por inteligência artificial e sem digitação. A sincronização compara o acervo com a fonte, lista as diferenças antes de gravar, nunca altera pesquisas cadastradas pela equipe e guarda cópia do acervo anterior. Na auditoria de 29/09/2026 esse processo corrigiu 98 pesquisas em que colunas de candidatos haviam sido trocadas na importação anterior e acrescentou 95 que faltavam.
Próximas divulgações
Pesquisas já registradas, com campo em andamento ou divulgação prevista, aparecem na página da disputa como “próximas divulgações”. Elas não entram em nenhum cálculo até que os números sejam publicados. No Piauí e no Maranhão a lista vem direto dos registros do TSE e mostra apenas pesquisas com 800 entrevistas ou mais, para separar levantamentos estaduais de pesquisas municipais registradas na mesma UF.
Protocolo do TSE em cada pesquisa
O protocolo de registro é vinculado à pesquisa do acervo somente quando existe um único registro com o mesmo instituto, o mesmo fim de campo (tolerância de um dia) e amostra equivalente (diferença de até 3%). Casos ambíguos ou com amostra divergente ficam sem protocolo até conferência manual — o vínculo nunca altera os números da pesquisa.
Ressalvas
Cenários estimulados de 1º turno. Quando um instituto testa mais de um cenário, usamos o que contém mais candidatos do cenário principal. A contagem de registros no PesqEle/TSE vem do arquivo de dados abertos do TSE; a data da base aparece ao lado do número em cada disputa.
Candidatos que se retiram e mudanças de cenário
Quando um candidato retira a candidatura, ele é marcado como retirado com a data: sai da média, da "foto de agora" e do identificador de cenário, mas seu histórico permanece na tabela (coluna marcada com †). Quando o conjunto de candidatos do cenário principal muda após as convenções (ex.: entrada de novos nomes na disputa presidencial), as pesquisas anteriores que não mediram os novos nomes contribuem apenas para os candidatos que mediram — a série dos novos começa quando passam a ser medidos.
Senado — duas vagas
Em 2026 cada estado elege dois senadores e o eleitor vota em dois nomes. Os institutos divulgam o resultado de duas formas: em % dos votos (candidatos, brancos e indecisos somam 100) ou como soma das duas menções (o total soma 200). Misturar as duas escalas distorce a média — um candidato com “40%” numa escala equivale a “20%” na outra.
Desde a v1.4 o agregador converte tudo para % dos votos (escala 100), a mesma base em que o TSE divulga o resultado: pesquisas na escala 200 são divididas por 2 e marcadas com “÷2” na tabela. A escala é identificada pela soma da linha publicada; quando a soma não permite decidir, vale o padrão do mesmo instituto nas demais pesquisas (marcada como inferida); se ainda assim não for possível, a pesquisa fica fora da média com o selo “escala indefinida”. Os números originais ficam preservados no banco e nos downloads (coluna escala_publicada).
Limitação: a divisão por 2 é uma aproximação — supõe que os eleitores usam os dois votos de forma parecida entre os candidatos. Por isso o efeito do instituto tende a ser maior no Senado do que nas disputas de uma vaga.
Quem faz
O agregador é uma parceria entre o IPPI Pesquisas e Consultoria (Teresina-PI), responsável pela metodologia, coleta e curadoria dos dados, e o podcast Café Quente com Rogério Cafeteira, contratante das pesquisas do IPPI no Maranhão e parceiro de divulgação. As pesquisas do próprio IPPI entram na média com o mesmo tratamento das demais — e seu efeito de instituto é exibido, por transparência.
Comparador instituto × média
Em cada disputa, o painel "Instituto × média" mostra as pesquisas de um instituto (pontos e linha tracejada) sobre a média agregada (linha cheia). A distância entre as duas é a forma visual do efeito do instituto; a tabela logo abaixo dá o mesmo dado com leave-one-out, shrinkage e nível de confiança.
Fechamento: como o agregador é avaliado
Depois da apuração, a página Resultado × agregador compara a média final (só pesquisas encerradas até a véspera) com o resultado oficial do TSE. Como o TSE divulga votos válidos e a média usa intenção total, os dois lados são recalculados apenas entre os candidatos acompanhados, somando 100. Publicamos o erro médio por candidato, o erro na margem da linha de corte, quantos resultados ficaram dentro do intervalo de 95% e a posição do agregador frente à última pesquisa de cada instituto. Nenhum peso ou regra é alterado depois de conhecido o resultado.
Lição do 1º turno de 2026. O intervalo de 95% conteve o resultado em apenas 5 de 21 candidatos: ele mede a dispersão entre as pesquisas, não o erro comum a todos os institutos nem a decisão dos indecisos na reta final. Deve ser lido como “faixa de concordância entre pesquisas”, não como margem de erro da eleição.
Histórico de versões
Fechamento do 1º turno — 4 de outubro de 2026: página de resultado com a pontuação do agregador e dos institutos contra a apuração oficial.
v1.4.1 — 29 de setembro de 2026: base do TSE atualizada (arquivo de 29/09), protocolo oficial vinculado a 179 pesquisas do acervo e próximas divulgações de Piauí e Maranhão a partir dos registros.
v1.4 — 29 de setembro de 2026: Senado normalizado para % dos votos (escala 100/200); extração determinística das tabelas-fonte com auditoria completa do acervo; período de campo (início–fim) e próximas divulgações; gráfico com seleção de período; tabela com filtros; novo visual.
v1.3 — setembro de 2026: comparador instituto × média; widget embed com modo compacto; tratamento de candidatos retirados; cenário presidencial ampliado (Cury, Renan Santos, Caiado); Senado PI e MA ativados com 2 vagas; paleta para até 8 candidatos; padronização de nomes de institutos; endpoint de saúde.
v1.2 — julho de 2026: efeito do instituto por leave-one-out com shrinkage e níveis de confiança; intervalo de incerteza por Monte Carlo; classificação de competitividade (empate técnico no agregado).
v1.1 — julho de 2026: separação entre série histórica e média atual; sistema explícito de elegibilidade com selos por pesquisa; identificador de cenário; funil de transparência do TSE; data de referência e de atualização; padronização de nomes.
Metodologia IPPI v1.4.