Er is een hele categorie websites die elke ochtend gratis voetbalvoorspellingen publiceren: een speelschema, een tip, soms een percentage ernaast. Ze worden door veel mensen gelezen. Ze worden door bijna niemand gecontroleerd, omdat controleren tijdrovend is — je zou moeten vastleggen wat er voor aftrap werd voorspeld, wachten op de resultaten en weten welke prijs je daadwerkelijk had kunnen nemen.
Dat is precies wat onze infrastructuur al doet voor tipsters op Telegram. Dus hebben we die op twee van de beter bekende gratis sites gezet, Statarea en Zulubet, en zijn we gaan meten.
Dit artikel is geen oordeel. Het is de methode, plus de eerste dag aan data, nu gepubliceerd zodat niemand ons later kan verwijten dat we de klok pas zijn gaan starten zodra de cijfers ons uitkwamen.
Stap 5 is het deel dat de meeste "verificatie"-diensten overslaan, en het is het deel dat bepaalt of de andere cijfers überhaupt iets betekenen.
| Statarea | Zulubet | |
|---|---|---|
| Publieke voorspellingen gelezen | 65 | 82 |
| Gekoppeld aan een fixture die we volgen | 19 | 28 |
| Tot nu toe afgehandeld | 19 | 5 |
| Correct | 7 | 2 |
| Accuracy | 36.8% | 40.0% |
| Gemiddelde odds op die picks | 2.10 | 2.21 |
| Benodigde break-even accuracy | 47.6% | 45.3% |
Beide zitten onder de accuracy die ze nodig zouden hebben tegen de prijzen die hun picks hadden. En beide cijfers zijn betekenisloos, omdat 19 en 5 afgehandelde voorspellingen ruis zijn. Eén goede avond verschuift ze met tien punten. We publiceren ze toch, omdat het alternatief — stilzwijgend wachten tot de steekproef iemand gunstig gezind is — is hoe deze sector zijn reputatie verdient.
De twee kolommen die over een maand ertoe doen zijn de laatste twee. Accuracy op zichzelf beslist nooit iets: een site die alleen op korte favorieten tipt kan 70% van de tijd goed zitten en toch geld verliezen, iets wat we in detail hebben gemeten bij een populaire AI-tipster over 25,890 wedstrijden. Wat het beslist is accuracy afgezet tegen de break-even rate bij de odds die je had kunnen nemen, en daarnaast closing line value.
Van de 147 voorspellingen die we op de eerste dag lazen, konden we er 47 koppelen. Dat is geen fout van hen of van ons — deze sites dekken veel meer competities dan de 83 leagues die wij prijzen. Een voorspelling op een league die wij niet volgen kan niet eerlijk worden beoordeeld, dus die wordt apart gezet en apart geteld, in plaats van stilletjes verwijderd of, erger nog, als verlies meegeteld.
Dit is hetzelfde patroon dat we zagen bij het auditen van Telegram-tipsters: over 46 kanalen lazen we 1,279 publieke picks en konden we er 567 afhandelen. De meetbare subset is altijd kleiner dan het gepresenteerde record, en elke audit die je de omvang daarvan niet vertelt, vraagt om vertrouwen in plaats van controle.
Statarea publiceert een tip. Zulubet publiceert een probability voor thuis, gelijk en uit, en markeert de grootste — dat is meer dan de meeste gratis sites bieden, en het maakt de site op een strengere manier controleerbaar.
Een probability is een falsifieerbare claim. Als een voorspeller op een paar honderd momenten 70% zegt, dan zou de uitkomst ongeveer 70% van de tijd moeten optreden. Als het 50% van de tijd gebeurt, is het getal decoratie. We slaan nu elke probability op die Zulubet publiceert, naast het uiteindelijke resultaat, zodat die pagina in de tijd niet alleen kan beantwoorden "verslaat het de closing line" maar ook "zijn de genoemde probabilities überhaupt gekalibreerd" — dezelfde test die we uitvoeren op ons eigen model, dat we, voor de duidelijkheid, publiceerden nadat het slechter uitkwam dan de market.
Beide pagina's worden bijgewerkt zodra de data binnenkomt en onthouden zich van elk oordeel totdat er per site minstens 30 afgehandelde voorspellingen zijn:
Als de cijfers uiteindelijk gunstig uitvallen voor een van beide sites, zullen we dat zeggen. We hebben onze eigen verliesweken gepubliceerd, onze eigen model dat slechter gekalibreerd was dan de market, en een meetfout die onze eigen closing line value kortstondig met dertig punten oppomptte. Het punt van openbaar meten is dat het resultaat niet aan ons is om te kiezen.
Method notes: voorspellingen worden één keer per dag gelezen van de openbare pagina's van de sites met een identificerende user agent; ruwe pagina's worden privé gearchiveerd en nooit opnieuw gepubliceerd. Fixture matching gebruikt normalisatie van teamnamen met een alias-tabel; niet-gematchte picks worden gemarkeerd als niet-verifieerbaar en picks op niet-gedekte competities vallen buiten scope — geen van beide telt als verlies. Price at detection is de beste soft-bookmaker price die we voor die selectie op het moment van lezen hebben. Closing line value = price at detection ÷ scherpe closing price − 1 op dezelfde market. We hebben geen affiliatie met, en geen commerciële relatie tot, een van beide sites.