O Veredito da IA: 5 Descobertas Surpreendentes sobre a Apuração das Eleições de 2026
1. Introdução: O Mistério da Tela Parada e a Resposta dos Dados
Na noite de 4 de outubro, milhões de brasileiros encaravam a mesma tela congelada no sistema de divulgação do Tribunal Superior Eleitoral (TSE). Por mais de uma hora, a apuração presidencial estancou, e, quando os números finalmente voltaram a rodar, a vantagem do candidato da frente havia encolhido drasticamente. Simultaneamente, nos quadros estaduais de São Paulo, chamava a atenção o abismo de votos entre o governador eleito e o presidenciável por ele apoiado. A pergunta que tomou conta das redes sociais e das rodas de conversa foi inevitável: estávamos diante de uma anomalia sistêmica ou apenas da matemática eleitoral em curso?
Para responder a essa dúvida sem recorrer a achismos ou especulações ideológicas, o engenheiro de software Gabriel Carvalho desenhou uma investigação orientada por dados. A proposta: reconstruir a noite da eleição segundo a segundo, reprocessando a apuração de ponta a ponta a partir dos registros oficiais contidos nos Boletins de Urna (BU) disponibilizados pelo TSE.
O desafio técnico foi colossal. Uma esteira automatizada de análise de dados tratou os arquivos de quase 500 mil sessões eleitorais espalhadas pelo Brasil — um volume bruto de cerca de 6 GB de informação. Para assegurar o rigor metodológico e a total imparcialidade, todas as regras de auditoria foram travadas no código antes de qualquer processamento. Entre elas, uma premissa fundamental: o alinhamento político entre candidatos foi categorizado estritamente pelo apoio oficial declarado e comprovado por links de fontes públicas, sem deduções partidárias automáticas.
O resultado dessa devassa algorítmica desmonta mitos consolidados ao longo da noite de apuração e isola com precisão cirúrgica onde reside a única e real anomalia técnica do pleito de 2026.
2. Ponto 1: A "Virada" que Nunca Aconteceu — A Matemática Exata da Ordem de Chegada
Durante a transmissão ao vivo da apuração, a vantagem de Flávio sobre Lula atingiu seu ápice às 17h58, registrando 10,8 pontos percentuais de distância. A partir daí, a margem encolheu continuamente até fechar em 1,87%. Para quem acompanhava os painéis da imprensa, a sensação era de uma virada iminente. No entanto, a reconstrução linha do tempo provou que Flávio liderou a contagem de ponta a ponta: nunca houve virada, mas sim o afunilamento gradual de uma margem inicial.
A explicação para essa dinâmica é estritamente geográfica e diz respeito à velocidade da infraestrutura de transmissão regional:
- Sul e Centro-Oeste: Apresentaram uma apuração extremamente veloz. Às 19h, quase 90% das urnas dessas regiões (quase 9 em cada 10) já haviam sido processadas pelo sistema central do TSE.
- Nordeste: Às 19h, apenas metade das urnas nordestinas tinha entrado na base de dados. Trata-se do reduto onde Lula obteve sua maior vantagem regional, vencendo por quase 33 pontos de diferença.
À medida que o fluxo do Nordeste ganhou volume no sistema, a vantagem de Flávio encolheu de forma matematicamente inevitável. Para provar se o encolhimento era fruto exclusivo dessa assimetria regional, o modelo de simulação rodou um teste de estresse: embaralhou a ordem de chegada de todas as urnas do país 1.000 vezes (como quem reembaralha um baralho). O resultado foi categórico: sem o viés de chegada das regiões, a vantagem permaneceria estável em torno de 2 pontos percentuais durante toda a noite, sem jamais se aproximar do pico de 10 pontos. A ordem de chegada regional explicou isoladamente 70% da queda registrada; os 30% restantes decorreram do fluxo interno de chegada entre os próprios municípios de cada estado.
Comparativo Temporal de Queda da Liderança
2022: Queda de ~11,0 pontos (Resultado: Virada no placar)
2026: Queda de ~8,5 pontos (Resultado: Manutenção da liderança)
Na comparação histórica com 2022, o fenômeno foi ainda mais acentuado naquele pleito: Jair Bolsonaro abriu vantagem inicial e perdeu quase 11 pontos até sofrer a virada. Em 2026, a redução foi de cerca de 8,5 pontos, demonstrando um comportamento regular e dentro dos parâmetros normais da apuração brasileira. Já em relação a 2018, essa simulação segundo a segundo não pôde ser replicada porque o TSE não disponibilizou os horários de chegada individuais de cada BU naquele pleito, tornando 2022 o único parâmetro temporal perfeitamente comparável.
"Ainda que seja óbvio, é importante analisar se os dados também contam essa história — e, neste caso, contam sim."
3. Ponto 2: O Apagão de 28 Minutos — 20.000 Urnas Represadas e a Única Anomalia do Pleito
O instante mais crítico da noite ocorreu exatamente às 19h, quando a tela de divulgação oficial travou na marca de 64,8% das urnas apuradas. O painel permaneceu congelado por mais de uma hora, destravando apenas às 20h08, já com 85% de consolidação. Embora a soma final exibida após o destravamento correspondesse perfeitamente aos boletins reais recebidos, a auditoria nos registros de data e hora (timestamps) de recepção dos arquivos revelou um padrão totalmente atípico.
Entre 19h31 e 19h59, os servidores do TSE registraram um intervalo de 28 minutos sem o recebimento de absolutamente nenhum Boletim de Urna. Para dimensionar a estranheza desse "vazio de dados", em toda a eleição de 2022 o maior intervalo sem recepção de boletins durou apenas 7 minutos.
Imediatamente após esse apagão, entre 19h59 e 20h05, o sistema processou uma onda súbita de 20.000 boletins em um exíguo intervalo de 6 minutos. Eram dados vindo de urnas cuja votação havia sido encerrada há mais de duas horas.
Linha do Tempo da Anomalia Temporal (19h00 20h08)
├── 19h00: Tela de apuração trava na marca de 64,8%
├── 19h31 às 19h59: [APAGÃO DE DADOS] Zero BUs registrados em 28 min (vs. max 7 min em 2022)
├── 19h59 às 20h05: Represamento destrava: entrada súbita de 20.000 BUs em 6 min
└── 20h08: Painel público atualiza abruptamente para 85%
A análise diagnóstica aponta para o comportamento típico de uma fila travada por gargalo de processamento ou congestionamento nos servidores de recepção do TSE. Importante ressaltar: a auditoria confirmou que os votos dessas 20.000 urnas represadas mantiveram estrita fidelidade aos padrões demográficos e históricos de suas respectivas zonas eleitorais. Não houve injeção de votos nem alteração de perfil. Contudo, como o travamento ocorreu na camada de infraestrutura interna do tribunal, os dados públicos não conseguem auditar a causa raiz do problema.
"Acredito que isso é algo que de fato merece uma explicação real do TSE com mais detalhes, tendo em vista que estamos numa democracia e nós precisamos do máximo de transparência possível."
4. Ponto 3: O Fenômeno São Paulo — Desmontando a Discrepância Entre Aliados
No maior colégio eleitoral do país, chamou a atenção do eleitorado a distância entre os desempenhos de Tarcísio de Freitas (62,6% na disputa ao governo) e Flávio Bolsonaro (51,9% na corrida presidencial). Uma aparente contradição de quase 11 pontos percentuais entre aliados políticos diretos.
Todavia, a decomposição matemática revela que grande parte dessa disparidade é uma ilusão de ótica gerada pelo cálculo dos votos válidos:
- Abstenção de Voto para o Governo: O eleitorado paulista registrou rigorosamente o dobro de votos brancos e nulos para o cargo de governador em relação ao cargo de presidente.
- Efeito no Denominador: Como a porcentagem oficial de votos válidos exclui brancos e nulos, o divisor da fração no cargo de governador ficou consideravelmente menor. Essa base encolhida inflou artificialmente o percentual de Tarcísio.
- Métrica sobre o Total de Votantes: Ao reajustar a conta e calcular a porcentagem sobre o total de eleitores que compareceram às urnas (incluindo brancos e nulos), a diferença real entre Tarcísio e Flávio cai de 10,7 para apenas 6 pontos percentuais.
Além disso, a análise espacial confirmou que essa diferença não foi causada por municípios isolados ou fora do padrão: ela ocorreu de forma homogênea em todas as 645 cidades do estado de São Paulo. O modelo de transferência de votos estimou que 87% dos eleitores de Tarcísio votaram em Flávio para a Presidência; o percentual restante pulverizou-se principalmente entre as candidaturas de Ronaldo Caiado e Renan Santos, caracterizando o clássico fenômeno do "voto dividido".
Historicamente, divergências desse porte entre aliados de chapa estão longe de ser inéditas. Em 2022, Ratinho Júnior (PR) superou Jair Bolsonaro em 14 pontos percentuais, e Romeu Zema (MG) abriu 12,5 pontos de vantagem sobre o presidenciável apoiado. Em contraste, em 2018, todos os governadores aliados eleitos em primeiro turno terminaram a menos de 3 pontos de distância de Bolsonaro. O cenário de São Paulo em 2026 insere-se perfeitamente dentro da variabilidade histórica brasileira.
5. Ponto 4: "Voto Casado" Absoluto no Senado e Zero Cidades Suspeitas
Na disputa para o Senado Federal, a esteira de análise identificou uma fidelização partidária sem precedentes recentes. O Partido Liberal (PL) conquistou 19 cadeiras senatoriais, todas localizadas em estados onde Flávio venceu ou empatou na disputa presencial. Em nenhum estado onde Lula saiu vitorioso ou empatado houve eleição de senadores daquela sigla. A correlação entre o voto para presidente e senador foi significativamente mais forte do que as observadas em 2018 e 2022. Mesmo nos estados do Nordeste onde o PL teve desempenho acima da sua média histórica, o fenômeno foi explicado pela presença de duas vagas ao Senado, levando eleitores de Lula a concederem o segundo voto ao candidato do PL.
Para checar a integridade do processo no nível municipal, o sistema rodou uma varredura de anomalias em todos os 5.273 municípios brasileiros. Para evitar falsos positivos, estabeleceu-se uma regra metodológica rígida: uma cidade só seria classificada como "suspeita" se atendesse simultaneamente a três critérios de estresse:
- Taxa de comparecimento eleitoral estatisticamente incompatível com o padrão de votação da região;
- Padrão de voto presidencial com desvio extremo em relação ao histórico de 2022;
- Discrepância desproporcional e sem correlação entre o voto para presidente e os demais cargos da proporcional.
O resultado do algoritmo de integridade identificou zero cidades suspeitas em 2026. Aplicando exatamente a mesma régua rigorosa sobre a base de dados da eleição de 2022, o indicador também resultou em zero municípios fora da curva, demonstrando estabilidade sistêmica no comportamento do eleitorado.
6. Ponto 5: Transparência Radical e a Precisão de 99,96%
Para executar essa auditoria, a esteira de dados baixou aproximadamente 6 GB de arquivos contendo as informações das quase 500 mil sessões eleitorais do país. Para garantir a rastreabilidade e a imutabilidade do processo, gerou-se e armazenou-se o código hash criptográfico de verificação de cada arquivo no momento do download, assegurando que nenhum dado fosse adulterado durante o processamento.
|
Métrica do Estudo e Auditoria |
Dado Obtido / Métrica Oficial |
|
Volume de Dados Processados |
~6 GB de dados puros do TSE |
|
Sessões Eleitorais Analisadas |
498.112 sessões (~500 mil) |
|
Votos Presidenciais Auditados |
+119 milhões de votos válidos |
|
Consistência em São Paulo |
Confirmada em todas as 645 cidades |
|
Cidades Suspeitas (3 Critérios Simultâneos) |
0 / 5.273 municípios |
|
Sessões Ausentes no Repositório TSE |
15 sessões (3.900 votos residuais) |
|
Precisão da Soma Aberta vs. Resultado TSE |
99,96% de alinhamento exato |
A soma direta voto a voto realizada pela pipeline resultou em um alinhamento de 99,96% com o total oficial divulgado pelo TSE. A diferença infima de 3.900 votos presidenciais refere-se a apenas 15 sessões cujos arquivos de BU não foram publicados no repositório de dados abertos do tribunal.
Fiel ao compromisso de transparência radical, todo o código-fonte em Python, os scripts de automação, os hashes de validação e as tabelas resultantes foram disponibilizados em um repositório público de código aberto (open source), permitindo que qualquer auditor, jornalista ou cidadão possa clonar os dados e replicar o estudo de forma independente.
7. Conclusão: O Limite dos Dados Públicos e o Futuro da Apuração
O veredito final produzido pela análise de dados é objetivo: em todas as dimensões auditáveis por meio de arquivos públicos, a apuração das Eleições de 2026 seguiu rigorosamente os padrões matemáticos, geográficos e comportamentais observados em pleitos anteriores. A contagem dos Boletins de Urna fecha com o resultado anunciado pelo TSE, a redução da vantagem inicial reflete o fluxo de transmissão regional e não existem municípios discrepantes dos padrões históricos.
No entanto, a investigação estabelece com clareza a fronteira inviolável da ciência de dados: a análise pública prova que a soma dos papéis impressos pelas urnas bate com o placar da TV, mas dados públicos não conseguem auditar o código-fonte executado dentro da urna eletrônica nem os processos internos do servidor central do TSE.
O ecossistema do projeto segue em expansão. A mesma estrutura algorítmica já foi testada com sucesso no desenvolvimento de um checador de fatos automatizado em tempo real aplicado às sabatinas de Lula e Flávio. A ferramenta agora está sendo aprimorada para cobertura ao vivo dos debates do segundo turno, paralelamente ao desenvolvimento de um modelo preditivo baseado na velocidade de transmissão regional para projetar a curva da apuração na etapa decisiva.
Em uma democracia cada vez mais ancorada em processos digitais, fica a provocação central: a transparência dos dados públicos de saída é suficiente para garantir a confiança total do eleitorado, ou o futuro da integridade eleitoral exigirá a abertura irrestrita e em tempo real de todas as camadas internas do sistema?
Comentários (0)
Seja o primeiro a comentar.
Postar um comentário
O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *