A cada pleito, voltamos a nossa atenção para o que as pesquisas de opinião projetam para o dia da eleição. No primeiro turno de 2026, Flávio Bolsonaro (PL) terminou com 47,03% dos votos válidos e Lula (PT), com 45,16% — uma diferença de menos de dois pontos. Com uma disputa tão apertada, o segundo turno de 25 de outubro trará de volta a discussão sobre as pesquisas, publicadas por vários institutos e produzidas com metodologias distintas.
Especialmente porque a ciência política tem procurado compreender como a divulgação de pesquisas eleitorais afeta a percepção de competitividade do pleito e a decisão dos eleitores de comparecer às urnas, precisamos entender melhor como devemos interpretar a intenção de voto e os problemas que devem nos preocupar.
Por exemplo, Morton, Muller, Page e Torgler (2015) demonstram que onde a votação ocorreu após a publicação das pesquisas de boca de urna na França, observou-se uma redução de 11 pontos percentuais na participação eleitoral e um incremento nos votos direcionados ao candidato apontado como vencedor nos territórios ultramarinos franceses.
As pesquisas de intenção de voto são uma ferramenta fundamental para a leitura do cenário político e do comportamento do eleitor. Ao mesmo tempo, há fatores que limitam a profundidade a que podemos chegar com esses levantamentos no formato em que atualmente são divulgados pelos institutos.
O principal obstáculo é que precisamos avaliar essas pesquisas, seus planos amostrais e as metodologias de ponderação registradas no TSE baseando-nos exclusivamente em relatórios fechados, sem acesso aos microdados.
Qual é o problema disso? Os microdados são as respostas anonimizadas de cada pessoa entrevistada. O acesso a esses dados serve não apenas para auditar os resultados e realizar cruzamentos, mas principalmente para destrinchar a aplicação das ponderações e aprimorar a ciência por trás das pesquisas.
Para mostrar o tipo de informação que podemos extrair dos microdados, vale a pena olhar para trás: em 2022, a eleição terminou com margem de menos de dois pontos de diferença entre Lula e Jair Bolsonaro. Os microdados de algumas pesquisas de opinião realizadas em 2022 hoje estão públicos.
A título de exemplo, vamos focar nas duas últimas pesquisas de 2022 – realizadas na véspera do segundo turno da eleição – com dados disponíveis no CESOP: uma da Datafolha e outra do Ipec. Com base nestes documentos publicados no TSE por estes institutos e nos bancos de dados disponibilizados no CESOP/Unicamp (os arquivos 04785, 04809 e 04954 do CESOP/Unicamp e os registros BR-08297/2022, BR-05256/2022 e SP-03973/2022 do TSE), podemos realizar uma análise retrospectiva que ajuda a entender melhor as diferenças da informação publicada na véspera da eleição e do resultado do segundo turno.
Com base em dados provenientes das 8.308 entrevistas realizadas entre 28 e 29 de outubro de 2022, o Datafolha estimou 52% dos votos válidos para Lula. Com base nos dados das 4.272 entrevistas realizadas pelo Ipec entre 27 e 29 de outubro de 2022, o Ipec estimou em 54%. Os dois institutos divulgaram a mesma margem de erro: 2 pontos percentuais. No segundo turno, realizado no dia 30 de outubro, Luiz Inácio Lula da Silva foi eleito com 50,9% dos votos. A diferença entre Lula e Jair Bolsonaro foi de 1,8 ponto — 50,9% a 49,1% dos votos válidos.
A figura abaixo compara o resultado oficial do segundo turno com cinco estimativas diferentes, obtidas a partir das mesmas pesquisas. A primeira usa apenas as respostas coletadas, sem qualquer ponderação. As duas seguintes são de outra natureza: descartamos o peso do instituto e construímos um novo, usando apenas as variáveis que cada empresa registrou no TSE
No Datafolha, partimos de sexo, idade e escolaridade e depois acrescentamos as regiões; no Ipec, partimos de regiões e sexo por idade e depois acrescentamos sexo por escolaridade. Como os registros não trazem informações geográficas, as participações regionais foram tomadas do próprio peso do instituto.
Essas estimativas respondem a uma pergunta simples: utilizando as variáveis que cada instituto declarou utilizar, é possível chegar à estimativa de intenção de voto no segundo turno que cada instituto publicou?
A quarta estimativa aplica o peso que cada instituto efetivamente atribuiu, conforme consta nos microdados arquivados no CESOP/Unicamp, e reproduz o número divulgado na véspera da eleição. A quinta ajusta esse mesmo peso para que a amostra reproduza a divisão oficial do voto no primeiro turno entre os eleitores, isto é, as mesmas proporções de votos em Lula, em Bolsonaro, nos demais candidatos e em branco ou nulo. Os entrevistados que não votaram no primeiro turno mantêm o peso que já tinham.
Na figura, as barras grossas indicam o intervalo de confiança de 95% de cada estimativa, calculado com os erros-padrão dos microdados; a linha fina com traços, desenhada apenas na estimativa divulgada, indica a margem de erro de ± 2 pontos anunciada pelos institutos; e as linhas verticais tracejadas marcam o resultado oficial de cada candidato.
Fontes: microdados do CESOP/Unicamp e resultados oficiais do TSE.

Notas: A ordem dos resultados na figura segue a ordem das notas.*
-
Resultado oficial do segundo turno (TSE) e linhas tracejadas: Bolsonaro 49,1; Lula 50,9.
-
Sem ponderação: média e erro-padrão de amostra aleatória simples.
-
Pesos construídos com as variáveis registradas no TSE pelos institutos. Datafolha: sexo, idade e escolaridade; Ipec: regiões e sexo x idade. Erro-padrão tratando o peso como fixo.
-
Pesos construídos com as variáveis registradas no TSE pelos institutos acrescentando regiões (Datafolha) ou sexo x escolaridade (Ipec). As participações regionais vêm do peso do próprio instituto.
-
Como divulgado: peso fornecido pelo instituto com os microdados, que reproduz o número publicado. Erro-padrão tratando o peso como fixo.
-
O peso como divulgado pelo instituto ajustado (pós-estratificação) para reproduzir a divisão oficial do voto no primeiro turno entre os eleitores, segundo o voto declarado. Erro-padrão de pós-estratificação, que leva o ajuste em conta e por isso é menor.
* Nenhum erro-padrão inclui a conglomeração, dado que não há identificação dos municípios e estados nos microdados.
Quais conclusões podemos extrair deste exercício? Por um lado, pesos construídos com as variáveis que cada instituto registrou no TSE não reproduzem exatamente os números divulgados. Usando essas variáveis (e, para as regiões, as participações implícitas no próprio peso do instituto), Lula teria 54,0–54,9% dos votos válidos no Datafolha e 55,4–55,5% no Ipec, contra 52,5% e 53,5% divulgados.
Por outro lado, com a ponderação da amostra ajustando pelos votos do primeiro turno, chegamos a estimativas que aproximam o resultado divulgado pelos institutos. Calibrar pesquisas pelo voto anterior é uma prática comum: o Pew Research Center mostra que cerca de 70% das pesquisas nos EUA de 2024 foram calibradas pela identificação partidária ou pelo voto anterior.
Nessas últimas semanas da eleição de 2026, o que implica tudo isso? Esse breve exercício ilustra como é de suma importância entender o que está por trás dos valores publicados e suas limitações. Essa compreensão, se promovida de forma ampla e pública, melhora a conexão entre o conhecimento especializado sobre esses dados e o debate público.
Sem uma maior transparência sobre os métodos de ponderação e reajustes, como o discutido anteriormente, ou mesmo a divulgação dos próprios microdados, essa compreensão ampla e pública, ancorada no conhecimento científico, não é possível.
Precisamos promover caminhos para discutir os desenhos e limitações das pesquisas de opinião de forma clara e pública, para poder, assim, não só aprimorá-las, mas informar com precisão, municiando leitores das ferramentas críticas necessárias para interpretar os dados divulgados.