Quem ganha? Um estimador que ajusta viés de instituto, tendência e o erro de 2022
Agregação de 68 pesquisas de 1º turno e 73 de 2º turno desde abril, com efeito de casa por instituto, regressão local no tempo e três cenários de correção pelo erro histórico das pesquisas brasileiras. Resultado: empate técnico no 2º turno; o favoritismo de Lula depende inteiramente de quanto você acredita que os institutos corrigiram a subestimação da direita.
Probabilidades por cenário de viés
Em 2022 as pesquisas finais superestimaram a margem de Lula sobre Bolsonaro em — pontos no 1º turno e — no 2º (média Datafolha, Quaest, Ipec, Atlas). Escolha quanto desse erro você espera que se repita.
Simulação Monte Carlo (200 mil) por cenário: tendência projetada ± erro do agregador, menos o viés assumido (com incerteza), mais o erro sistemático de véspera-para-urna típico no Brasil (desvio de pts no 1º turno e no 2º). "Demais" candidatos somam 12% ± 2 dos válidos.
Segundo turno: a série que decide
Dois a dois, excluindo brancos e nulos, cada instituto deslocado pelo seu efeito de casa. A tendência de setembro é quase plana: queda em agosto e início de setembro, recuperação parcial de Lula nas duas últimas semanas.
Efeito de casa por instituto
Desvio médio de cada instituto em relação à tendência comum na margem Lula−Flávio (pontos). Positivo: tende a mostrar Lula melhor; negativo: Flávio melhor. Estimado por mínimos quadrados com restrição de soma zero.
MDA/CNT é o maior outlier pró-Lula; PoderData, Vox e Futura são os mais pró-Flávio. Datafolha e AtlasIntel ficam perto do centro, o que faz a última Datafolha (45×40 válidos) pesar bastante na projeção.
Deriva de campanha
Regressão linear da margem ajustada contra o tempo desde o início da campanha oficial (16/8).
| pontos/dia | erro-padrão | n | implica até a urna |
|---|
No 1º turno a convergência é estatisticamente clara (quase 4 erros-padrão): Flávio ganhou ~0,8 ponto de margem por semana desde agosto, sobretudo consolidando votos de Cury, Caiado e Renan. No 2º turno a deriva não é distinguível de zero.
Por renda: onde a eleição se decide
Recortes do Datafolha de 15–17/9 (votos totais). A última coluna é a elasticidade: quanto a margem nacional se move se 1 ponto trocar de Lula para Flávio dentro do grupo (2 × peso do grupo no eleitorado).
| Grupo | peso | Lula | Flávio | margem | ± | elast. |
|---|
Simulador: mova um grupo e veja o 2º turno
Comparado com a semana final de 2022, Lula perdeu cerca de 10 pontos de margem entre os mais pobres (de +30 para +17) e manteve o resto. A eleição é decidida ali: o grupo de até 2 salários mínimos tem elasticidade 1,04, mais do que todos os outros somados.
Transferência de votos no 2º turno
Os ~12% dos demais candidatos são majoritariamente de direita (Caiado, Zema, Renan; Cury é mais difuso). Três hipóteses de alocação, partindo da projeção de 1º turno sem correção:
| Hipótese | Lula | Flávio | margem |
|---|
Método, dados e limites
Como o estimador funciona
- Normalização. Cada pesquisa é convertida para votos válidos (1º turno: exclui brancos, nulos e indecisos; 2º turno: parcela de Lula sobre Lula + Flávio). Isso elimina a maior diferença entre institutos (Atlas quase sem indecisos; Quaest com 15–19%).
- Efeito de casa. Regressão da margem Lula−Flávio sobre uma base polinomial no tempo mais dummies de instituto com soma zero, ponderada por √(n/2000). O resíduo é o ruído por pesquisa ( pts no 1º turno).
- Tendência. Regressão local linear com kernel gaussiano (banda de 18 dias) sobre as margens ajustadas, projetada para 4/10. Para 25/10 usa-se o nível na última pesquisa mais incerteza de passeio aleatório, sem extrapolar inclinação.
- Viés histórico. Erro das pesquisas finais de 2022 (1º turno: +6,5; 2º: +2,5 a favor de Lula) e 2018 (praticamente zero). Os cenários aplicam 0%, 50% ou 100% desse erro com incerteza crescente.
- Erro sistemático. Além do viés, cada simulação recebe um choque normal com desvio histórico de pesquisas finais no Brasil.
Fontes
- Série de pesquisas: Wikipedia (EN/PT) "Opinion polling for the 2026 Brazilian presidential election", conferida contra G1, Poder360, CNN Brasil e Gazeta do Povo.
- Datafolha 28/9–1/10 (BR-08039/2026): votos válidos Lula 45 × Flávio 40; 2º turno 48 × 45.
- Recortes por renda, região, religião e escolaridade: Datafolha 15–17/9 (BR-04029/2026).
- Erros históricos: resultados oficiais TSE 2018 e 2022 contra últimas pesquisas publicadas.
O que isso não captura
- Pesquisas de sábado 3/10 (Datafolha, Quaest, Atlas) ainda não existem; o cancelamento do debate de 1/10 e a entrevista de Lula no Flow não estão medidos.
- Os pesos por renda são aproximações da composição amostral do Datafolha, não do TSE.
- Pesquisas de setembro de Nexus, PoderData e Atlas entram só no 2º turno (1º turno não foi divulgado de forma consistente nas fontes acessíveis).
- O viés de 2022 pode não se repetir: parte veio de abstenção diferencial e da inclusão tardia de eleitores de baixa renda; os institutos ajustaram metodologia desde então.
Isto é um exercício estatístico, não aconselhamento. Modelo e dados montados em 2/10/2026.