Brizen.
Motor de projeção

Todo número aqui vem com a régua.

O motor transforma histórico em probabilidade. Esta página mostra o número que ele calcula, a régua com que esse número é medido e o que a medição devolveu — sem escolher só a parte boa.

01motor

O que o motor faz

De dois times e uma régua de liga, sai quantos gols cada lado tende a fazer

O motor não assiste ao jogo, não lê notícia e não tem opinião sobre quem está mais motivado. Ele recebe três coisas: o histórico do time da casa, o histórico do visitante e a régua da liga — quantos gols aquela competição costuma produzir, por mando. Com isso ele separa, para cada time, o quanto ele ataca e o quanto ele é vulnerável, sempre em relação à liga em que jogou.

A saída são dois números: a média de gols esperada da casa e a do visitante. Desses dois números nasce uma matriz de placares — a probabilidade de cada resultado exato — e todo mercado sai dessa mesma matriz. Não existe um modelo por mercado que possa contradizer o outro: é uma fonte só.

  1. 1
    Histórico dos dois times
    Jogos passados de cada lado, com os mais recentes pesando mais.
  2. 2
    Régua da liga
    A média de gols daquela competição, por mando — o ponto zero da comparação.
  3. 3
    Ataque × vulnerabilidade
    Cada time vira um par de fatores relativos à régua, não uma média bruta.
  4. 4
    Os dois λ
    Ataque de um lado combinado com a fragilidade do outro, por mando.
  5. 5
    Matriz de placares
    Todo mercado — 1X2, handicap, over/under — é lido dessa matriz.

A versão do motor descrita aqui foi ajustada em 808.591 jogos e medida em um conjunto de teste separado, de 16.781 jogos em 86 ligas, que foi aberto uma única vez. Todo número desta página vem dessa passada.

02motor

O λ — o número central

O que ele é, e o que costumam confundir com ele

λ (lambda) é a média de gols esperada de um lado naquele jogo específico. Na base inteira, a média de gols por partida fica em torno de 2,70 — o λ de um jogo concreto é essa referência empurrada para cima ou para baixo pelo ataque de um time e pela defesa do outro.

O que o λ não é: previsão de placar. Um λ de 1,6 para a casa não diz que a casa marca dois gols, nem um, nem que o jogo termina de um jeito específico. Diz qual é a distribuição de gols plausível se aquele mesmo jogo fosse disputado muitas vezes — e é dessa distribuição, não de um palpite de placar, que saem as probabilidades de cada mercado.

Quem procura o placar no λ está lendo a ferramenta errada. O λ é a forma da incerteza, não o fim dela.
03motor

Como se mede o erro

Brier — a distância entre o que o motor disse e o que aconteceu

Dizer “o modelo acertou” não significa nada quando a saída é probabilidade. A régua usada aqui é o Brier: para cada jogo, mede-se o quadrado da distância entre a probabilidade dita e o que de fato aconteceu, e tira-se a média. Quanto menor, melhor; zero seria adivinhação perfeita, que não existe.

O número sozinho não informa. O que informa é a comparação com duas referências deliberadamente burras: o chute cego (dar a mesma probabilidade para todos os desfechos, sem olhar nada) e o palpite bobo (ignorar os times e repetir a taxa histórica daquela liga). Um modelo que não bate o palpite bobo não está aprendendo nada sobre os times.

MercadoChute cegoPalpite boboMOTOR
1X20,653870,644880,61568
Over 1.50,183440,180360,18176
Over 2.50,249710,244150,24502
Over 3.50,211510,206290,20829
Ambas marcam0,249480,248220,24754

O 1X2 tem três desfechos e o Brier dele vive em outra escala: compare coluna com coluna, dentro da mesma linha, nunca linha com linha.

A leitura honesta da tabela é esta: o motor bate as duas referências no 1X2 com folga, e nas linhas de gols a vantagem sobre o palpite bobo é pequena ou inexistente. Isso não é um defeito de implementação — tem explicação, e ela está na seção 07.

04motor

Calibração

Quando digo 30%, acontece 30%

Calibração é a propriedade mais simples de explicar e a mais difícil de obter: separe todos os jogos em que o motor disse “30%”, e a coisa tem que ter acontecido em cerca de 30% deles. Um modelo descalibrado mente sobre a própria confiança — e, apostando, mentir para cima é caro.

O Brier se decompõe em três parcelas que explicam de onde vem o erro: confiabilidade (o quanto a probabilidade dita destoa da frequência real — quanto menor, melhor), resolução (o quanto o modelo consegue afastar os jogos da média, separando os prováveis dos improváveis — quanto maior, melhor) e incerteza (o quanto o próprio esporte é imprevisível — não depende do modelo, é o teto do problema).

ParcelaMOTORLeitura
Brier por par0,20662o erro total, na escala binária
Confiabilidade0,00010quanto menor, mais honesta a probabilidade
Resolução0,01498quanto maior, mais o modelo separa os jogos
Incerteza0,22222o piso do futebol, igual para todo modelo

A falta de calibração do motor equivale a 0,045% da incerteza do esporte. Em linguagem de operação: quando o motor diz 30%, acontece 30%. É a melhor calibração já registrada no projeto — e é também a parte boa da história.

05motor

O limite do motor

Honesto nas probabilidades, pouco decidido entre os jogos

Calibração alta com resolução baixa descreve um modelo honesto e pouco decidido. Ele raramente exagera na confiança, mas também raramente se afasta muito da média da liga. A resolução medida é 0,01498 contra uma incerteza de 0,22222 — ou seja, o motor recupera uma fração pequena do que há para recuperar.

E o ganho das peças novas veio quase todo do lado da calibração: a resolução subiu de 0,01488 para 0,01498, um avanço pequeno perto do que a calibração melhorou. As peças novas calibram mais do que discriminam.

O que isso significa na prática
  • 01Discordâncias grandes com o mercado são raras — e quando aparecem, a suspeita de dado ruim vem antes da euforia.
  • 02O caminho de evolução não é mais calibração, é informação nova. Na literatura, o vão entre um modelo e o mercado está quase todo em resolução.
  • 03O motor responde com o próprio modelo em 85,9% dos jogos e recua para o encolhimento em 14,1% — nesses, a projeção está perto da média da liga por construção.
06motor

Os ajustes, e por que cada um existe

Três peças que só ficaram porque a medição pediu

Cada ajuste do motor teve que justificar a própria existência num teste, e cada um age só onde foi medido. Peça que melhora um mercado e vaza para os outros é peça que ninguém consegue auditar depois.

O fator de totais
λ × 1,035, e apenas no over/under.

O motor projetava gols de menos de forma consistente — o desvio aparecia em todas as linhas, sempre no mesmo sentido. A correção é de nível, não de forma: empurra o total para cima sem mexer em quem marca. Fora do over/under o efeito dela é exatamente zero, e há teste travando isso.

O ρ desligado
A correção de Dixon-Coles para placares baixos está em zero.

É a peça mais citada da literatura e foi reprovada aqui. Verificado no nosso próprio código: ela é inerte no over/under 2.5 — não muda nada — e empurra cerca de 1,96 pp de probabilidade para o empate, onde o motor não precisava de ajuda. Ficou desligada.

O encolhimento
Time com pouco histórico é puxado para a média da liga, com força κ = 2.

Cinco jogos não sustentam um rating. Em vez de fingir precisão, o motor encolhe a estimativa em direção à régua da liga na medida da evidência disponível. Efeito colateral que vale dizer: nesses casos a faixa de projeção fica estreita não por conhecimento, mas porque a média da liga não varia — por isso o tamanho da amostra sempre viaja junto do número.

A memória
Decaimento exponencial com meia-vida de 5.

O passado conta cada vez menos quanto mais antigo. Memória mais curta foi testada, ganhou na fatia interna e perdeu na validação — encurtar joga jogos demais para dentro do encolhimento. Ficou a mais longa, que foi a que sobreviveu fora da amostra.

07motor

Onde operamos, e onde paramos

Cada veto tem um motivo medido, não uma preferência

O motor produz probabilidade para muito mais mercado do que a operação usa. A diferença entre “o motor calcula” e “a operação aposta” é a medição: só vai para a mesa o mercado em que o motor provou bater as referências burras.

Tudo sai de uma matriz só. O motor estima quantos gols cada lado tende a marcar e monta a probabilidade de cada placar possível — 0-0, 1-0, 2-1, e assim por diante. Todo mercado de gol é uma leitura diferente dessa mesma tabela: quem vence é a soma de um triângulo, o total é a soma das diagonais, o handicap reagrupa as células. Não há um modelo para cada mercado; há um modelo, lido de vários ângulos. É por isso que a conta é barata e que os mercados não se contradizem entre si.

E vencedor é um handicap. “O mandante vence” e “o mandante com handicap de −0,5” são o mesmo evento — o empate derruba os dois. Por isso 1X2 e handicap asiático não são duas famílias: são a mesma, com a diferença de que o handicap também existe em −1, −1,5 e assim por diante, para quando a vantagem do favorito é maior que um gol.

A margem da casa, medida por nós

Toda odd embute a comissão da casa. Ela não vem escrita em lugar nenhum — sai da conta: some o inverso das odds de um mercado, e o quanto passar de 100% é o que a casa cobra. Medimos em 36 jogos de 7 ligas na Pinnacle, que é a casa mais barata do mercado:

Handicap asiático3,35%
Total de gols3,83%
1X2 (três vias)4,60%

Isso importa porque a margem é o piso que a vantagem precisa superar. Operadores profissionais sustentam de 1% a 6% de retorno ao ano; num mercado que cobra 10% de comissão, nenhuma leitura de jogo paga a conta. Os três acima são os mais baratos do cardápio — e não é coincidência que sejam onde o motor foi medido.

Uma armadilha que a nossa própria medição desfez: a tabela acima sugere preferir o handicap ao 1X2, já que a comissão agregada é menor. Fomos conferir no mesmo evento — “o mandante vence”, que existe nos dois mercados — em 53 jogos: o handicap pagou em média 0,30% a menos, e só pagou mais em 10 deles. A comissão de três vias se espalha por três seleções; a de duas, por duas. Escolher o mercado pelo rótulo da margem não rende nada — o que rende é o preço da seleção específica contra a probabilidade real.

1X2 e moneyline — opera
É onde o motor é claramente melhor que as referências.

Bate o chute cego e o palpite bobo com margem que sobrevive ao conjunto lacrado, e é também o mercado onde a calibração foi medida com mais amostra.

Handicap asiático — opera
Sai da mesma matriz do 1X2, com push e linha de quarto tratados.

Herda a qualidade do núcleo: é uma leitura diferente da mesma distribuição de placares, não um modelo paralelo.

Over/under — opera, com ressalva escrita
A vantagem sobre a média da liga não foi provada — em over 2.5, a diferença medida foi 0,00087 a favor do palpite bobo, com intervalo cruzando zero.

Há razão algébrica: quando os gols de cada lado são contagens independentes, a soma também é uma contagem — e, dado o total, saber como ele se divide entre os times é informação descartável. O modelo de time só ajudaria se estimasse a soma melhor que a média da liga, e somar dois números ruidosos é pior que estimar a soma direto. O mercado segue vivo porque o motor bate a engine anterior nas três linhas; a ressalva anda junto.

Ambas marcam — não opera
Bate todos os modelos de gols e não bate a taxa base da liga.

Ambos marcam acontece em 52,2% dos jogos: é quase uma moeda, e isso põe um teto no que qualquer modelo pode ganhar ali. Repetir essa taxa sem olhar o jogo erra 0,24948; o motor chega a 0,24754. O espaço inteiro entre não saber nada e o nosso melhor modelo é de dois milésimos. E quase todo ele já está na taxa da própria liga, que erra 0,24822: o que o motor acrescenta por cima dela é 0,00068, com intervalo cruzando zero no teste lacrado — indistinguível de sorte. Pagar de 5% a 7% de comissão por uma vantagem que não se distingue de zero é o oposto do que esta página defende, então o mercado é recusado na origem: a projeção continua visível, ela só não vira aposta. O sinal existe e já se sabe onde mora; se um dia cruzar a linha num teste, o mercado volta.

Ao vivo — não opera
Não existe motor para in-play aqui.

Tudo nesta página foi ajustado e medido em estado de pré-jogo. Acompanhamento ao vivo, quando acontece, é leitura manual — e leitura manual não vira aposta publicada como se fosse saída de modelo.

Escanteios e cartões — não opera
E não é por falta de dado.

Temos escanteios em 28,2% dos jogos coletados e cartões amarelos em 27,4% — mais cobertura que o próprio xG, que aparece em 6,2%. O escanteio, aliás, já trabalha aqui: é uma das fontes que o motor usa para estimar força de ataque. O que não existe é modelo do mercado — ninguém mediu quantos escanteios um confronto tende a ter, nem validou isso contra uma referência burra. E esses mercados cobram bem mais que os três da tabela acima — a faixa de referência para escanteio e cartão é de 8% a 15%, contra os 3,35% do handicap. Seria preciso uma vantagem enorme só para empatar. Publicar mercado que o motor não projeta é opinião com aparência de número.

Mercados de jogador — não opera
Aqui o dado realmente não existe.

Quem marca, quantos chutes um atacante dá, quantos passes um meia completa: nada disso entra na nossa coleta de futebol, que é por PARTIDA e não por jogador. Um mercado de jogador exigiria fonte nova, modelo novo e validação nova — três coisas que não temos — e ainda enfrentaria a comissão mais cara do cardápio.

Placar exato — não opera
O motor calcula, e você vê o resultado na tela. Ainda assim não vira aposta.

A matriz de placar é literalmente a base de tudo o que esta página descreve, então a probabilidade de cada resultado existe e aparece na tela. O problema é o formato da aposta. Futebol não tem placar dominante: o resultado mais comum dos 861 mil jogos que coletamos é 1-1, e ele acontece em 11,5% das vezes. Dentro de um jogo específico não muda muito — o placar que o motor aponta como mais provável fica, na mediana, em 12,9%, o que é odd justa perto de 8. E o motor já recusa qualquer seleção acima de 4,00, porque nessa faixa o histórico mostra fechamento desfavorável. O placar exato não precisou de regra nova: o portão de cauda longa que já existia o elimina sozinho.

08motor

Benchmarks

Onde isso fica em relação ao que a literatura registra

A régua abaixo é o RPS, a variante do Brier que respeita a ordem dos desfechos do 1X2 — é a métrica que os artigos publicados costumam reportar, o que torna a comparação possível. Menor é melhor.

ReferênciaRPSProcedência
Mercado (odds de fechamento)0,2062citado da literatura
Melhor modelo publicado sem odds0,2090citado da literatura
Classe Dixon-Coles publicada0,2082citado da literatura
MOTOR — cinco grandes ligas0,20917medido no teste lacrado
MOTOR — ligas europeias comparáveis0,21123medido no teste lacrado
MOTOR — todas as ligas elegíveis0,21312medido no teste lacrado

Procedência importa: as linhas do MOTOR foram medidas no nosso conjunto de teste, aberto uma vez; as demais são citadas de trabalhos publicados.

As ressalvas vêm na frente, não no rodapé. Os recortes não são os mesmos: período diferente, ligas diferentes e agregação diferente — a nossa pondera cada liga por 1, a da literatura pondera cada jogo por 1. A comparação vale como ordem de grandeza, não como casa decimal. Com isso dito, o motor fica na faixa dos modelos publicados da classe Dixon-Coles e um pouco atrás do melhor modelo publicado sem odds.

E a linha que organiza tudo: nenhum modelo publicado sem odds bate o mercado. O alvo declarado na literatura é chegar a cerca de 0,003 do mercado — a meta é distância, não um número absoluto.

09motor

O que estes números não dizem

Calibração não é vantagem sobre a casa

Tudo nesta página mede o motor contra a realidade: ele diz 30% e acontece 30%. Nada aqui mede o motor contra o preço. São perguntas diferentes, e confundir as duas é o erro mais comum de quem lê um dossiê de calibração.

A linha de fechamento de uma casa sharp também é calibrada — e melhor que a nossa. Ter probabilidade honesta é condição necessária para apostar bem; não é condição suficiente, e não vira vantagem sozinha. Vantagem existe onde o motor discorda do preço e está certo na discordância, e isso esta página não prova.

Calibração diz que o motor não mente sobre a própria incerteza. Não diz que ele enxerga algo que o mercado não enxergou.

Quem julga o resto é o CLV — se a odd pega era melhor que a de fechamento —, e ele precisa de apostas e de amostra, não de backtest. Mais duas honestidades de método: o conjunto de teste já foi aberto, então qualquer número novo exige conjunto novo; e a força de liga continua inconclusiva, porque o recorte de jogos entre ligas é pequeno demais para decidir.

Próximo passo

Do motor até a aposta.

A probabilidade é só o começo. O que acontece entre ela e uma aposta publicada — fair odd, EV+, gates e CLV — está na página de metodologia.