Conectar carteira

Mercados de previsão são precisos? O que dizem os dados

Por insiderz7 min de leitura

Ilustração abstrata em fundo escuro de uma curva de calibração, com uma linha diagonal de referência, outra levemente arqueada e pontos espalhados ao redor

Mercados de previsão são precisos quando têm liquidez e prazo curto, mas pouco confiáveis quando essas condições faltam. Em uma amostra de plataformas com dados até 14 de outubro de 2025, a Polymarket registrou perda de Brier de 0,1652 e a Kalshi, 0,1982, ante 0,25 para quem responde sempre 50%. Só 67% dos mercados da Polymarket apontaram o vencedor da eleição dos EUA em 2024 acima de 50% em outro estudo.

O que mostram os números publicados sobre precisão?

A pontuação de Brier é a medida padrão. Primeiro, calcula-se a diferença entre a probabilidade informada e o resultado, representado por 1 ou 0. Depois, essa diferença é elevada ao quadrado e as pontuações são reunidas em uma média. Quanto menor, melhor. Responder 50% para tudo gera 0,25. A conta aparece em como funciona a pontuação de Brier.

A comparação pública entre plataformas que informa o tamanho de cada amostra é a brier.fyi. Ela avalia mercados binários e de múltipla escolha já resolvidos em quatro plataformas.

Plataforma Exige dinheiro Pontuação geral de Brier Mercados na amostra Dados até
Polymarket Sim 0,1652 259 14 de outubro de 2025
Metaculus Não 0,1664 153 14 de outubro de 2025
Kalshi Sim 0,1982 183 14 de outubro de 2025
Manifold Não 0,2118 376 14 de outubro de 2025
insiderz Não Ainda não há histórico resolvido 0 4 de setembro de 2026

Dados da brier.fyi. As amostras são pequenas e não comparam as mesmas perguntas em todas as plataformas. A ordem, portanto, é uma indicação, não uma conclusão. O resumo mais honesto é que as quatro ficam em uma faixa aproximada de 0,16 a 0,21. A Metaculus, que não usa dinheiro real, está dentro dessa faixa.

A insiderz foi lançada em setembro de 2026 e ainda não tem histórico próprio de eventos resolvidos. Qualquer afirmação sobre sua precisão hoje seria inventada, por isso não há nenhuma nesta página. Os totais existentes aparecem abaixo.

insiderz agora

Ao vivo do insiderz.
calls
0
insiders
0
eventos resolvidos
0
eventos abertos
1.894

Como a precisão é medida na prática?

Três medidas diferentes recebem o nome de precisão, mas não significam a mesma coisa.

  • Taxa de acerto. Mostra em que parcela dos mercados o resultado final ficou acima de 50%. É simples, mas ignora por completo o grau de confiança.
  • Pontuação de Brier. Mede a média do erro quadrático da probabilidade. Recompensa a confiança quando ela é justificada e a pune quando não é.
  • Calibração. Verifica se afirmações feitas com 70% se realizam em cerca de 70% das vezes. Um mercado pode acertar muitos favoritos e ainda ter calibração ruim.

Muitas manchetes usam a taxa de acerto porque ela produz o maior número. Quando você lê "94% de precisão", confira se isso representa uma pontuação de Brier ou apenas uma contagem de favoritos vencedores.

O que os estudos da eleição de 2024 realmente encontraram?

Dois resultados apontam em direções diferentes, e ambos são reais.

O resultado crítico vem de Joshua D. Clinton e TzuFeng Huang, da Universidade Vanderbilt. Eles analisaram mais de 2.500 mercados políticos da Iowa Electronic Markets, Kalshi, PredictIt e Polymarket nas cinco semanas finais da campanha de 2024. O resultado final ficou acima do acaso em 93% dos mercados da PredictIt, 78% dos mercados da Kalshi e 67% dos mercados da Polymarket. O estudo encontrou pouca evidência de eficiência: contratos idênticos tinham preços diferentes entre bolsas, as mudanças diárias eram pouco correlacionadas ou tinham autocorrelação negativa e as oportunidades de arbitragem atingiram o pico nas duas semanas finais (Clinton e Huang, SocArXiv, 2025). A maior plataforma teve o pior resultado. Uma reportagem sobre o estudo registrou que a Kalshi contestou a metodologia e defendeu a calibração, não a taxa de acerto, como medida correta (DL News, 5 de dezembro de 2025).

O resultado favorável vem de um estudo sobre o funcionamento interno da Polymarket entre 5 de janeiro e 6 de novembro de 2024. A sensibilidade do preço ao fluxo de ordens caiu de cerca de 0,53 no fim de julho de 2024 para aproximadamente 0,01 em outubro. A meia-vida das diferenças entre os preços de Sim e Não passou de várias horas no início de 2024 para bem menos de um minuto em outubro e novembro (Tsang e Yang, arXiv:2603.03136, agosto de 2026). No fim, o principal mercado era difícil de mover e fechava rapidamente suas próprias diferenças.

As duas conclusões podem coexistir. Um mercado principal profundo pode funcionar bem enquanto os outros 2.000 ao redor dele funcionam mal.

No Brasil, a disputa presidencial de 2022 também mostra por que um único resultado não mede a precisão de um sistema. Em 30 de outubro de 2022, às 19h56, o TSE considerou Luiz Inácio Lula da Silva eleito com 98,91% das urnas apuradas. Naquele momento, ele tinha 50,83% dos votos válidos, ante 49,17% de Jair Bolsonaro (TSE, 30 de outubro de 2022). Uma previsão para essa eleição forneceria apenas um resultado. Seriam necessárias muitas eleições ou perguntas comparáveis para julgar sua calibração.

Em quais situações os mercados são mais fracos?

Quatro condições sinalizam um preço ruim e podem se combinar.

  • Volume baixo. Mercados rasos são a opinião de uma pessoa acompanhada de um preço.
  • Prazo longo. Quanto mais distante a resolução, mais os preços se aproximam de 50%.
  • Texto ambíguo. O mercado é resolvido pela regra escrita, não pelo título.
  • Resolução contestada. Quando a regra permite discussão, o preço incorpora o risco da disputa. Veja como mercados de previsão são resolvidos.

O efeito do prazo já foi medido. Em 353 milhões de negociações e 429.000 contratos binários de Kalshi e Polymarket, os mercados políticos mostraram confiança persistentemente baixa e preços comprimidos na direção de 50%. Um contrato a 70 centavos um mês antes do fim correspondeu a uma probabilidade real mais próxima de 75%. O modelo explicou 87,3% da variação de calibração na amostra da Kalshi e 71,5% fora da amostra (Le, arXiv:2602.19520, fevereiro de 2026). A palavra importante é "estruturado". O erro não é ruído. Ele tem uma direção, e um previsor pode tentar aproveitá-la.

Com que frequência uma pessoa supera o mercado?

Isso acontece com frequência suficiente para merecer medição, mas raramente uma história isolada prova algo.

O melhor parâmetro público para indivíduos é o ForecastBench, que apresentou as mesmas perguntas ainda não resolvidas a superprevisores, ao público geral e a grandes modelos de linguagem. No conjunto de perguntas humanas, os superprevisores tiveram pontuação média de Brier de 0,096. O público geral obteve 0,121 e o melhor modelo testado, 0,122. As duas diferenças tiveram significância estatística, com p inferior a 0,001 (Karger et al., arXiv:2409.19839, revisão de fevereiro de 2025). Pessoas habilidosas realmente se separam da multidão, e a diferença pode ser medida.

Isso não equivale a superar o preço de um mercado específico em um evento específico. Para demonstrar essa vantagem, você precisa da sua probabilidade, da probabilidade do mercado no mesmo instante e do resultado resolvido, repetidos em dezenas de eventos. Menos do que isso é apenas uma história.

Método: como esta página foi construída e quando é atualizada?

  • Escopo. Estudos publicados sobre precisão de Polymarket, Kalshi, PredictIt, Metaculus e Manifold, além de parâmetros para previsores humanos. Sem fontes de afiliados nem páginas promocionais das plataformas.
  • Preferência de medida. Primeiro a pontuação de Brier, depois a calibração e por último a taxa de acerto, sempre identificada como tal.
  • Tamanho da amostra. Todo número desta página traz o tamanho da amostra e a data, ou não entra no texto.
  • Exclusões. Afirmações como "X% de precisão" sem amostra, data ou definição da medida. Há muitas.
  • Frequência. Esta página é revisada pelo menos a cada 90 dias e depois da resolução de qualquer eleição importante. Última verificação em 4 de setembro de 2026.
  • O que a insiderz acrescentará. As calls na insiderz ficam travadas com o horário e o preço da Polymarket naquele instante. Quando os eventos forem resolvidos, será possível comparar com clareza a probabilidade de uma pessoa à do mercado no mesmo momento. Ainda não há dados em quantidade útil, por isso eles não são publicados aqui.

Os eventos abertos estão em Eventos. As pessoas classificadas por Bate o mercado, Eventos, Edge e Antecipação aparecem no ranking.

Perguntas frequentes

Qual é a precisão da Polymarket?
Em uma amostra de mercados resolvidos em várias plataformas até 14 de outubro de 2025, a Polymarket teve pontuação geral de Brier de 0,1652 em 259 mercados, o melhor resultado entre as quatro plataformas comparadas. A precisão cai bastante em mercados de baixo volume e prazo longo.
Mercados de previsão são melhores do que pesquisas?
Em eleições de curto prazo, geralmente sim, pois agregam pesquisas e outras informações. Em perguntas de longo prazo ou muito técnicas, a vantagem diminui.
O que é uma boa pontuação de Brier?
Cerca de 0,25 equivale a responder 50% sempre. Superprevisores chegaram à média de 0,096 no conjunto de perguntas humanas do ForecastBench. Abaixo de 0,10 é um resultado de elite.
Os preços agregam informações de modo eficiente?
Nem sempre. Um estudo com mais de 2.500 mercados nas cinco semanas finais da campanha dos EUA em 2024 encontrou diferenças entre preços de contratos idênticos em bolsas distintas e oportunidades de arbitragem até o dia da eleição.

Fontes

  1. Prediction Markets? The Accuracy and Efficiency of $2.4 Billion in the 2024 Presidential Election, Joshua D. Clinton and TzuFeng Huang, SocArXiv, 2025
  2. Are Polymarket and Kalshi as reliable as they say? Not quite, study warns, DL News, 5 December 2025
  3. Prediction market accuracy by platform, brier.fyi, data updated 14 October 2025
  4. ForecastBench: A Dynamic Benchmark of AI Forecasting Capabilities, Karger et al., arXiv:2409.19839, revised 28 February 2025
  5. Decomposing Crowd Wisdom: Domain-Specific Calibration Dynamics in Prediction Markets, Nam Anh Le, arXiv:2602.19520, February 2026
  6. The Anatomy of a Blockchain Prediction Market: Polymarket in the 2024 U.S. Presidential Election, Kwok Ping Tsang and Zichao Yang, arXiv:2603.03136, August 2026
  7. Lula é eleito novamente presidente da República do Brasil, Tribunal Superior Eleitoral, 30 de outubro de 2022

Continue lendo

Mercados de previsão: como o preço vira probabilidade

Um mercado de previsão permite negociar contratos que pagam 1 se um evento acontecer e 0 se ele não acontecer. O último preço negociado fica entre 0 e 1. Por isso, um contrato a 34 centavos representa uma chance de 34%. Esse preço é uma afirmação coletiva sobre o futuro e, como qualquer afirmação, pode ser superado.

7 min de leitura

Mercado, pesquisa ou comentarista: quem acertou?

Na disputa presidencial dos EUA em 2024, o mercado se inclinou para o vencedor final, enquanto o principal modelo baseado em pesquisas não fez o mesmo. Em 4 de novembro de 2024, a Polymarket dava 58% a Trump. A previsão final do 538 atribuía 50 em 100 a Harris e 49 em 100 a Trump. Comentaristas nem sequer produziram um número que pudesse ser avaliado. Uma eleição não encerra o debate, e a mesma base de mercados parece bem pior quando a amostra aumenta.

7 min de leitura

Dinheiro real melhora as previsões?

O dinheiro não parece comprar precisão. O principal teste direto comparou um mercado com dinheiro real a outro com dinheiro fictício em 208 jogos da NFL em 2003. Não houve diferença estatisticamente significativa em quatro regras de pontuação. Pontuações de Brier entre plataformas até outubro de 2025 também colocaram mercados com e sem dinheiro na mesma faixa. O dinheiro compra atenção, liquidez e poder para grandes participantes moverem um preço.

7 min de leitura

Escore de Brier explicado sem complicação

O escore de Brier mede a distância entre suas probabilidades e a realidade. Em cada previsão, subtraia o resultado, escrito como 1 para “aconteceu” e 0 para “não aconteceu”, da probabilidade informada e eleve a diferença ao quadrado. A média vale zero para um resultado perfeito, 0,25 quando você diz 50% sempre e 1 para o maior erro possível.

8 min de leitura