O sistema de classificação Elo, desenvolvido pelo professor de física Arpad Elo para a Federação de Xadrez dos EUA em 1960, resolveu um problema fundamental na classificação competitiva: como medir a habilidade relativa entre jogadores que não jogam entre si. Ao modelar a probabilidade de vitória como uma função logística da diferença de classificação e atualizar as classificações após cada jogo com base nos resultados reais versus esperados, a Elo criou um sistema que se ajusta continuamente a novas informações sem exigir um único torneio round-robin. A elegância e a precisão do design original do Elo tornaram-no a base para sistemas de classificação em xadrez, Go, jogos online, esportes coletivos e até mesmo revisão acadêmica por pares.

A matemática da pontuação esperada

A fórmula de pontuação esperada E = 1/(1 + 10^((R_opp − R_me)/400)) mapeia diferenças de classificação para probabilidades de vitória usando uma curva logística. O fator de escala de 400 é uma convenção: Arpad Elo o escolheu de forma que uma diferença de classificação de 400 pontos corresponda a uma proporção de pontuação esperada de 10:1 – o que significa que o jogador com classificação mais alta deve marcar aproximadamente 10 pontos para cada 1 ponto que o jogador com classificação mais baixa pontua. Com 0 diferença de classificação, E = 0,5 (50% de probabilidade de vitória). Em +200 pontos, E ≈ 0,76; em +400, E ≈ 0,91; em +600, E ≈ 0,97. A forma logística reflete a observação empírica de que as diferenças de habilidade no xadrez produzem aproximadamente esta distribuição de probabilidade de vitória. A fórmula Elo original usava uma distribuição normal em vez de logística, mas a versão logística (adotada pela FIDE em 1978) é matematicamente equivalente para a maioria dos propósitos e mais fácil de calcular.

Fator K: Estabilidade vs. Capacidade de Resposta

O fator K controla a volatilidade do sistema de classificação. Um K alto permite que as classificações mudem rapidamente, o que é apropriado quando a verdadeira força de um jogador é incerta (novos jogadores, juniores em rápida melhoria) — o sistema de classificação precisa “encontrar” o nível certo rapidamente. Um K baixo produz classificações estáveis ​​que mudam lentamente, apropriadas para jogadores de elite estabelecidos, cuja verdadeira força é conhecida com alta confiança. A FIDE usa três níveis de fator K: K=40 para jogadores em seus primeiros 30 jogos ou abaixo de 2.300, K=20 para jogadores estabelecidos (2.100–2.400), K=10 para jogadores de elite acima de 2.400 com experiência de jogo vitalícia. Plataformas de xadrez online como Chess.com e Lichess costumam usar fatores K mais altos (32–64) porque os jogos online são mais rápidos e numerosos, permitindo uma convergência mais rápida para a verdadeira força. A consequência de um factor K elevado é que uma única perturbação pode alterar as classificações em 30-40 pontos; um K baixo significa que mesmo uma grande reviravolta move as classificações em apenas 8–10 pontos. Ambos estão corretos para os casos de uso pretendidos.

Elo Beyond Chess: esportes coletivos e jogos online

A elegância de Elo — exigindo apenas resultados de vitória/empate/derrota e classificações atuais — tornou-o ideal para adoção além do xadrez. A FIFA usa uma variante Elo para classificações de seleções nacionais que atribui pesos de partida por importância do torneio e ajusta o saldo de gols. A NFL tem usado classificações de potência baseadas em Elo para previsões desde 1980, e o modelo NFL Elo de FiveThirtyEight alcançou notável precisão de previsão. Os sistemas de matchmaking multijogador de videogame em League of Legends, Dota 2 e a maioria dos jogos competitivos usam Elo ou TrueSkill (uma extensão Bayesiana que lida com jogos em equipe e leva em conta a incerteza). O principal insight que tornou o Elo extensível: qualquer jogo de soma zero com resultados binários (vitória/derrota) ou resultados ordenados (vitória/empate/derrota) pode ser modelado com a mesma estrutura de pontuação esperada, com o fator K e a constante de escala ajustados ao ambiente competitivo específico do jogo. A principal limitação do Elo clássico para esportes coletivos é que ele trata as equipes como jogadores únicos: a média da variação de desempenho individual é calculada e as mudanças na escalação exigem ajuste manual.