Avaliação do modelo
Há uma pergunta a que qualquer modelo de futebol tem de responder antes de merecer atenção: é melhor do que a previsão implícita no mercado? A linha de fecho — o consenso do mercado imediatamente antes do apito inicial — é o padrão de referência em previsão desportiva, e nós fomos medir-nos contra ela. Não publicamos cotações nem sugestões de aposta: o mercado aparece aqui apenas como termo de comparação.
O veredicto, em 504 jogos ao longo de oito épocas: a partir da jornada 14 o modelo iguala a linha de fecho, e chega a ficar ligeiramente à frente. Toda a desvantagem está concentrada no primeiro terço da época, quando ainda há poucos jogos para aprender com eles. No conjunto da época a diferença é de +0,0010 com um erro padrão de 0,0021 — ou seja, indistinguível de zero.
Escrevemos isto com as barras de erro à vista de propósito. A única diferença nesta página que sobrevive ao seu próprio erro padrão é a do início da época; tudo o resto é compatível com um empate técnico, e seria desonesto vender de outra forma.
Diferença de RPS entre o modelo e a linha de fecho, jogo a jogo. Negativo = o modelo erra menos. 504 jogos, 8 épocas.
Jornadas 6 a 30
+0,0010
erro padrão 0,0021 · n = 504
A diferença é menor do que metade do seu próprio erro padrão: indistinguível de zero.
Jornadas 6-10
+0,0098
erro padrão 0,0045 · n = 144
O mercado está à frente, e aqui a diferença sobrevive ao erro padrão (t = 2,16).
Jornadas 14-30
−0,0025
erro padrão 0,0022 · n = 360
O modelo iguala a linha de fecho. O sinal é favorável, mas dentro do ruído.
Erro de previsão (RPS) do modelo e da linha de fecho, para cada jornada de referência. Mais baixo é melhor. As duas linhas cruzam-se entre a jornada 10 e a jornada 14.
Eixo vertical truncado (0,165–0,205) para tornar visível o cruzamento; as diferenças reais são as da faixa inferior. Cada ponto é uma jornada prevista em cada uma das 8 épocas (n = 72 jogos por ponto).
| Jornada | Modelo | Mercado | Diferença | Erro padrão |
|---|---|---|---|---|
| 6 | 0,1874 | 0,1784 | +0,0090 | 0,0067 |
| 10 | 0,1888 | 0,1782 | +0,0106 | 0,0062 |
| 14 | 0,1838 | 0,1880 | −0,0041 | 0,0049 |
| 18 | 0,2016 | 0,2017 | −0,0002 | 0,0047 |
| 22 | 0,1719 | 0,1788 | −0,0069 | 0,0041 |
| 26 | 0,1779 | 0,1790 | −0,0011 | 0,0046 |
| 30 | 0,1843 | 0,1844 | −0,0001 | 0,0065 |
Uma nota sobre incerteza, porque aqui ela decide tudo. A diferença global é +0,00103 com um erro padrão de 0,00207: o intervalo passa confortavelmente por zero, por isso não afirmamos que o mercado esteja à nossa frente no conjunto da época. A única diferença que sobrevive ao seu próprio erro padrão é a do início da época.
Modelo e mercado quase sempre veem o mesmo jogo. Estes são os casos em que não viram.
Em 53 dos 504 jogos (10,5%) o modelo e o mercado apontaram favoritos diferentes. Nesses jogos o favorito do mercado ganhou 22 vezes e o do modelo 15, com 16 a acabar num terceiro resultado. A diferença de erro nesse subconjunto é +0,0101, com erro padrão 0,0079 — demasiado ruidosa para arbitrar a questão.
Os oito jogos em que os dois favoritos mais se afastaram um do outro. “Nenhum” significa que saiu o terceiro resultado.
Avaliação em 504 jogos: oito épocas (2017-18 a 2024-25) × sete jornadas de referência (6, 10, 14, 18, 22, 26, 30). Em cada ponto o modelo é ajustado apenas com os jogos disputados até essa jornada e prevê a jornada seguinte — nunca vê o futuro. As probabilidades do mercado derivam das cotações de fecho publicadas pela football-data.co.uk (Pinnacle), com a margem retirada pelo método de Shin, e cobrem 100% dos jogos avaliados. O modelo avaliado é o mesmo que produz as previsões publicadas neste site.