O que o motor faz
De dois times e uma régua de liga, sai quantos gols cada lado tende a fazer
O motor não assiste ao jogo, não lê notícia e não tem opinião sobre quem está mais motivado. Ele recebe três coisas: o histórico do time da casa, o histórico do visitante e a régua da liga — quantos gols aquela competição costuma produzir, por mando. Com isso ele separa, para cada time, o quanto ele ataca e o quanto ele é vulnerável, sempre em relação à liga em que jogou.
A saída são dois números: a média de gols esperada da casa e a do visitante. Desses dois números nasce uma matriz de placares — a probabilidade de cada resultado exato — e todo mercado sai dessa mesma matriz. Não existe um modelo por mercado que possa contradizer o outro: é uma fonte só.
- 1Histórico dos dois timesJogos passados de cada lado, com os mais recentes pesando mais.
- 2Régua da ligaA média de gols daquela competição, por mando — o ponto zero da comparação.
- 3Ataque × vulnerabilidadeCada time vira um par de fatores relativos à régua, não uma média bruta.
- 4Os dois λAtaque de um lado combinado com a fragilidade do outro, por mando.
- 5Matriz de placaresTodo mercado — 1X2, handicap, over/under — é lido dessa matriz.
A versão do motor descrita aqui foi ajustada em 808.591 jogos e medida em um conjunto de teste separado, de 16.781 jogos em 86 ligas, que foi aberto uma única vez. Todo número desta página vem dessa passada.
O λ — o número central
O que ele é, e o que costumam confundir com ele
λ (lambda) é a média de gols esperada de um lado naquele jogo específico. Na base inteira, a média de gols por partida fica em torno de 2,70 — o λ de um jogo concreto é essa referência empurrada para cima ou para baixo pelo ataque de um time e pela defesa do outro.
O que o λ não é: previsão de placar. Um λ de 1,6 para a casa não diz que a casa marca dois gols, nem um, nem que o jogo termina de um jeito específico. Diz qual é a distribuição de gols plausível se aquele mesmo jogo fosse disputado muitas vezes — e é dessa distribuição, não de um palpite de placar, que saem as probabilidades de cada mercado.
Quem procura o placar no λ está lendo a ferramenta errada. O λ é a forma da incerteza, não o fim dela.
Como se mede o erro
Brier — a distância entre o que o motor disse e o que aconteceu
Dizer “o modelo acertou” não significa nada quando a saída é probabilidade. A régua usada aqui é o Brier: para cada jogo, mede-se o quadrado da distância entre a probabilidade dita e o que de fato aconteceu, e tira-se a média. Quanto menor, melhor; zero seria adivinhação perfeita, que não existe.
O número sozinho não informa. O que informa é a comparação com duas referências deliberadamente burras: o chute cego (dar a mesma probabilidade para todos os desfechos, sem olhar nada) e o palpite bobo (ignorar os times e repetir a taxa histórica daquela liga). Um modelo que não bate o palpite bobo não está aprendendo nada sobre os times.
| Mercado | Chute cego | Palpite bobo | MOTOR |
|---|---|---|---|
| 1X2 | 0,65387 | 0,64488 | 0,61568 |
| Over 1.5 | 0,18344 | 0,18036 | 0,18176 |
| Over 2.5 | 0,24971 | 0,24415 | 0,24502 |
| Over 3.5 | 0,21151 | 0,20629 | 0,20829 |
| Ambas marcam | 0,24948 | 0,24822 | 0,24754 |
O 1X2 tem três desfechos e o Brier dele vive em outra escala: compare coluna com coluna, dentro da mesma linha, nunca linha com linha.
A leitura honesta da tabela é esta: o motor bate as duas referências no 1X2 com folga, e nas linhas de gols a vantagem sobre o palpite bobo é pequena ou inexistente. Isso não é um defeito de implementação — tem explicação, e ela está na seção 07.
Calibração
Quando digo 30%, acontece 30%
Calibração é a propriedade mais simples de explicar e a mais difícil de obter: separe todos os jogos em que o motor disse “30%”, e a coisa tem que ter acontecido em cerca de 30% deles. Um modelo descalibrado mente sobre a própria confiança — e, apostando, mentir para cima é caro.
O Brier se decompõe em três parcelas que explicam de onde vem o erro: confiabilidade (o quanto a probabilidade dita destoa da frequência real — quanto menor, melhor), resolução (o quanto o modelo consegue afastar os jogos da média, separando os prováveis dos improváveis — quanto maior, melhor) e incerteza (o quanto o próprio esporte é imprevisível — não depende do modelo, é o teto do problema).
| Parcela | MOTOR | Leitura |
|---|---|---|
| Brier por par | 0,20662 | o erro total, na escala binária |
| Confiabilidade | 0,00010 | quanto menor, mais honesta a probabilidade |
| Resolução | 0,01498 | quanto maior, mais o modelo separa os jogos |
| Incerteza | 0,22222 | o piso do futebol, igual para todo modelo |
A falta de calibração do motor equivale a 0,045% da incerteza do esporte. Em linguagem de operação: quando o motor diz 30%, acontece 30%. É a melhor calibração já registrada no projeto — e é também a parte boa da história.
O limite do motor
Honesto nas probabilidades, pouco decidido entre os jogos
Calibração alta com resolução baixa descreve um modelo honesto e pouco decidido. Ele raramente exagera na confiança, mas também raramente se afasta muito da média da liga. A resolução medida é 0,01498 contra uma incerteza de 0,22222 — ou seja, o motor recupera uma fração pequena do que há para recuperar.
E o ganho das peças novas veio quase todo do lado da calibração: a resolução subiu de 0,01488 para 0,01498, um avanço pequeno perto do que a calibração melhorou. As peças novas calibram mais do que discriminam.
- 01Discordâncias grandes com o mercado são raras — e quando aparecem, a suspeita de dado ruim vem antes da euforia.
- 02O caminho de evolução não é mais calibração, é informação nova. Na literatura, o vão entre um modelo e o mercado está quase todo em resolução.
- 03O motor responde com o próprio modelo em 85,9% dos jogos e recua para o encolhimento em 14,1% — nesses, a projeção está perto da média da liga por construção.
Os ajustes, e por que cada um existe
Três peças que só ficaram porque a medição pediu
Cada ajuste do motor teve que justificar a própria existência num teste, e cada um age só onde foi medido. Peça que melhora um mercado e vaza para os outros é peça que ninguém consegue auditar depois.
O motor projetava gols de menos de forma consistente — o desvio aparecia em todas as linhas, sempre no mesmo sentido. A correção é de nível, não de forma: empurra o total para cima sem mexer em quem marca. Fora do over/under o efeito dela é exatamente zero, e há teste travando isso.
É a peça mais citada da literatura e foi reprovada aqui. Verificado no nosso próprio código: ela é inerte no over/under 2.5 — não muda nada — e empurra cerca de 1,96 pp de probabilidade para o empate, onde o motor não precisava de ajuda. Ficou desligada.
Cinco jogos não sustentam um rating. Em vez de fingir precisão, o motor encolhe a estimativa em direção à régua da liga na medida da evidência disponível. Efeito colateral que vale dizer: nesses casos a faixa de projeção fica estreita não por conhecimento, mas porque a média da liga não varia — por isso o tamanho da amostra sempre viaja junto do número.
O passado conta cada vez menos quanto mais antigo. Memória mais curta foi testada, ganhou na fatia interna e perdeu na validação — encurtar joga jogos demais para dentro do encolhimento. Ficou a mais longa, que foi a que sobreviveu fora da amostra.
Onde operamos, e onde paramos
Cada veto tem um motivo medido, não uma preferência
O motor produz probabilidade para muito mais mercado do que a operação usa. A diferença entre “o motor calcula” e “a operação aposta” é a medição: só vai para a mesa o mercado em que o motor provou bater as referências burras.
Tudo sai de uma matriz só. O motor estima quantos gols cada lado tende a marcar e monta a probabilidade de cada placar possível — 0-0, 1-0, 2-1, e assim por diante. Todo mercado de gol é uma leitura diferente dessa mesma tabela: quem vence é a soma de um triângulo, o total é a soma das diagonais, o handicap reagrupa as células. Não há um modelo para cada mercado; há um modelo, lido de vários ângulos. É por isso que a conta é barata e que os mercados não se contradizem entre si.
E vencedor é um handicap. “O mandante vence” e “o mandante com handicap de −0,5” são o mesmo evento — o empate derruba os dois. Por isso 1X2 e handicap asiático não são duas famílias: são a mesma, com a diferença de que o handicap também existe em −1, −1,5 e assim por diante, para quando a vantagem do favorito é maior que um gol.
Toda odd embute a comissão da casa. Ela não vem escrita em lugar nenhum — sai da conta: some o inverso das odds de um mercado, e o quanto passar de 100% é o que a casa cobra. Medimos em 36 jogos de 7 ligas na Pinnacle, que é a casa mais barata do mercado:
Isso importa porque a margem é o piso que a vantagem precisa superar. Operadores profissionais sustentam de 1% a 6% de retorno ao ano; num mercado que cobra 10% de comissão, nenhuma leitura de jogo paga a conta. Os três acima são os mais baratos do cardápio — e não é coincidência que sejam onde o motor foi medido.
Uma armadilha que a nossa própria medição desfez: a tabela acima sugere preferir o handicap ao 1X2, já que a comissão agregada é menor. Fomos conferir no mesmo evento — “o mandante vence”, que existe nos dois mercados — em 53 jogos: o handicap pagou em média 0,30% a menos, e só pagou mais em 10 deles. A comissão de três vias se espalha por três seleções; a de duas, por duas. Escolher o mercado pelo rótulo da margem não rende nada — o que rende é o preço da seleção específica contra a probabilidade real.
Bate o chute cego e o palpite bobo com margem que sobrevive ao conjunto lacrado, e é também o mercado onde a calibração foi medida com mais amostra.
Herda a qualidade do núcleo: é uma leitura diferente da mesma distribuição de placares, não um modelo paralelo.
Há razão algébrica: quando os gols de cada lado são contagens independentes, a soma também é uma contagem — e, dado o total, saber como ele se divide entre os times é informação descartável. O modelo de time só ajudaria se estimasse a soma melhor que a média da liga, e somar dois números ruidosos é pior que estimar a soma direto. O mercado segue vivo porque o motor bate a engine anterior nas três linhas; a ressalva anda junto.
Ambos marcam acontece em 52,2% dos jogos: é quase uma moeda, e isso põe um teto no que qualquer modelo pode ganhar ali. Repetir essa taxa sem olhar o jogo erra 0,24948; o motor chega a 0,24754. O espaço inteiro entre não saber nada e o nosso melhor modelo é de dois milésimos. E quase todo ele já está na taxa da própria liga, que erra 0,24822: o que o motor acrescenta por cima dela é 0,00068, com intervalo cruzando zero no teste lacrado — indistinguível de sorte. Pagar de 5% a 7% de comissão por uma vantagem que não se distingue de zero é o oposto do que esta página defende, então o mercado é recusado na origem: a projeção continua visível, ela só não vira aposta. O sinal existe e já se sabe onde mora; se um dia cruzar a linha num teste, o mercado volta.
Tudo nesta página foi ajustado e medido em estado de pré-jogo. Acompanhamento ao vivo, quando acontece, é leitura manual — e leitura manual não vira aposta publicada como se fosse saída de modelo.
Temos escanteios em 28,2% dos jogos coletados e cartões amarelos em 27,4% — mais cobertura que o próprio xG, que aparece em 6,2%. O escanteio, aliás, já trabalha aqui: é uma das fontes que o motor usa para estimar força de ataque. O que não existe é modelo do mercado — ninguém mediu quantos escanteios um confronto tende a ter, nem validou isso contra uma referência burra. E esses mercados cobram bem mais que os três da tabela acima — a faixa de referência para escanteio e cartão é de 8% a 15%, contra os 3,35% do handicap. Seria preciso uma vantagem enorme só para empatar. Publicar mercado que o motor não projeta é opinião com aparência de número.
Quem marca, quantos chutes um atacante dá, quantos passes um meia completa: nada disso entra na nossa coleta de futebol, que é por PARTIDA e não por jogador. Um mercado de jogador exigiria fonte nova, modelo novo e validação nova — três coisas que não temos — e ainda enfrentaria a comissão mais cara do cardápio.
A matriz de placar é literalmente a base de tudo o que esta página descreve, então a probabilidade de cada resultado existe e aparece na tela. O problema é o formato da aposta. Futebol não tem placar dominante: o resultado mais comum dos 861 mil jogos que coletamos é 1-1, e ele acontece em 11,5% das vezes. Dentro de um jogo específico não muda muito — o placar que o motor aponta como mais provável fica, na mediana, em 12,9%, o que é odd justa perto de 8. E o motor já recusa qualquer seleção acima de 4,00, porque nessa faixa o histórico mostra fechamento desfavorável. O placar exato não precisou de regra nova: o portão de cauda longa que já existia o elimina sozinho.
Benchmarks
Onde isso fica em relação ao que a literatura registra
A régua abaixo é o RPS, a variante do Brier que respeita a ordem dos desfechos do 1X2 — é a métrica que os artigos publicados costumam reportar, o que torna a comparação possível. Menor é melhor.
| Referência | RPS | Procedência |
|---|---|---|
| Mercado (odds de fechamento) | 0,2062 | citado da literatura |
| Melhor modelo publicado sem odds | 0,2090 | citado da literatura |
| Classe Dixon-Coles publicada | 0,2082 | citado da literatura |
| MOTOR — cinco grandes ligas | 0,20917 | medido no teste lacrado |
| MOTOR — ligas europeias comparáveis | 0,21123 | medido no teste lacrado |
| MOTOR — todas as ligas elegíveis | 0,21312 | medido no teste lacrado |
Procedência importa: as linhas do MOTOR foram medidas no nosso conjunto de teste, aberto uma vez; as demais são citadas de trabalhos publicados.
As ressalvas vêm na frente, não no rodapé. Os recortes não são os mesmos: período diferente, ligas diferentes e agregação diferente — a nossa pondera cada liga por 1, a da literatura pondera cada jogo por 1. A comparação vale como ordem de grandeza, não como casa decimal. Com isso dito, o motor fica na faixa dos modelos publicados da classe Dixon-Coles e um pouco atrás do melhor modelo publicado sem odds.
E a linha que organiza tudo: nenhum modelo publicado sem odds bate o mercado. O alvo declarado na literatura é chegar a cerca de 0,003 do mercado — a meta é distância, não um número absoluto.
O que estes números não dizem
Calibração não é vantagem sobre a casa
Tudo nesta página mede o motor contra a realidade: ele diz 30% e acontece 30%. Nada aqui mede o motor contra o preço. São perguntas diferentes, e confundir as duas é o erro mais comum de quem lê um dossiê de calibração.
A linha de fechamento de uma casa sharp também é calibrada — e melhor que a nossa. Ter probabilidade honesta é condição necessária para apostar bem; não é condição suficiente, e não vira vantagem sozinha. Vantagem existe onde o motor discorda do preço e está certo na discordância, e isso esta página não prova.
Calibração diz que o motor não mente sobre a própria incerteza. Não diz que ele enxerga algo que o mercado não enxergou.
Quem julga o resto é o CLV — se a odd pega era melhor que a de fechamento —, e ele precisa de apostas e de amostra, não de backtest. Mais duas honestidades de método: o conjunto de teste já foi aberto, então qualquer número novo exige conjunto novo; e a força de liga continua inconclusiva, porque o recorte de jogos entre ligas é pequeno demais para decidir.