Valintalista kertoo, mikä voitti. Kalibrointi kertoo, merkitsivätkö todennäköisyydet mitään: kun sanomme 60%, toteutuuko se 60% ajasta? Alla jokainen selvitetty ennuste kahdella tavalla arvioituna — sharp-markkina (de-vigattu) ja oma mallimme — epämukava vertailu näkyvissä.
Oma mallimme (Elo + formi): 0.617
Oma mallimme (Elo + formi): 1.028
Oma mallimme (Elo + formi): 0.4pp
Jokainen piste on 10 pisteen todennäköisyysväli (väh. 30 havaintoa). Mitä lähempänä diagonaalia, sitä paremmin kalibroitu. Jokainen ottelu vaikuttaa kaikkiin kolmeen lopputulokseen.
| Väli | Sharp-markkina (de-vigattu) — Ennuste (ka.) | Toteutunut | Hav. | Oma mallimme (Elo + formi) — Ennuste (ka.) | Toteutunut | Hav. |
|---|---|---|---|---|---|---|
| 0–10% | 7.4% | 5.6% | 270 | 7.5% | 7.1% | 112 |
| 10–20% | 16.2% | 17.5% | 1657 | 16.4% | 16.8% | 1056 |
| 20–30% | 25.3% | 25.1% | 5261 | 26% | 25.9% | 6205 |
| 30–40% | 34.3% | 33.6% | 2748 | 34.7% | 34.6% | 2646 |
| 40–50% | 44.8% | 43.9% | 1680 | 44.8% | 43.9% | 2047 |
| 50–60% | 54.6% | 56.2% | 1077 | 54.3% | 56% | 1024 |
| 60–70% | 64.4% | 63.9% | 598 | 63.9% | 64.3% | 381 |
| 70–80% | 74.6% | 79.2% | 240 | 74.1% | 75.2% | 105 |
| 80–90% | 83.7% | 86.1% | 72 | 83% | 88.2% | 34 |
Matalampi Brier ja log-loss ovat parempia; kalibrointivirhe on havaintopainotettu keskimääräinen ero ennustetun ja toteutuneen välillä. Rehellinen johtopäätös: de-vigattu sharp-markkina on paremmin kalibroitu kuin oma mallimme — juuri siksi tämä sivusto hinnoittelee kaiken markkinaa vasten eikä myy malliennusteita. Metodologia: todennäköisyydet sellaisina kuin ne näkyivät kirjaushetkellä, ei jälkisäätöä; tulokset virallisista lopputuloksista.
Täysi metodologia →