매일 아침 무료 축구 예측을 올리는 웹사이트들은 하나의 카테고리를 이룹니다. 경기 목록, 팁 하나, 때로는 옆에 퍼센트가 붙습니다. 많은 사람이 읽지만, 검증하는 사람은 거의 없습니다. 검증은 번거롭기 때문입니다. 킥오프 전에 무엇을 예측했는지 기록하고, 결과를 기다리고, 실제로 어떤 가격에 베팅할 수 있었는지 알아야 합니다.
그런 작업은 이미 텔레그램 팁스터에 대해 우리 인프라가 정확히 하고 있는 일입니다. 그래서 우리는 잘 알려진 무료 사이트 두 곳, Statarea와 Zulubet에 같은 시스템을 연결했고, 측정을 시작했습니다.
이 글은 판정문이 아닙니다. 방법과 첫날의 데이터를 공개하는 것이며, 나중에 숫자가 유리해졌을 때 시계를 그때부터 돌리기 시작했다고 누구도 말하지 못하게 하려는 목적입니다.
5단계는 대부분의 "verification" 서비스가 건너뛰는 부분이고, 다른 숫자들이 의미가 있는지 없는지를 결정하는 부분입니다.
| Statarea | Zulubet | |
|---|---|---|
| 읽은 공개 예측 수 | 65 | 82 |
| 우리가 커버하는 경기와 매칭 | 19 | 28 |
| 현재까지 정산됨 | 19 | 5 |
| 적중 | 7 | 2 |
| 정확도 | 36.8% | 40.0% |
| 해당 픽의 평균 배당 | 2.10 | 2.21 |
| 손익분기 정확도 필요치 | 47.6% | 45.3% |
두 곳 모두 해당 픽의 가격 기준으로 필요한 정확도 아래에 있습니다. 그리고 두 숫자 모두 의미가 없습니다. 정산된 예측이 19개와 5개뿐이면 잡음입니다. 좋은 저녁 하루만 있어도 수치가 10포인트씩 움직입니다. 그래도 공개하는 이유는 간단합니다. 반대로 조용히 기다리다가 샘플이 누군가에게 유리해질 때까지 숨기는 것이 이 업계가 평판을 얻는 방식이기 때문입니다.
한 달 뒤에 중요해질 두 칼럼은 마지막 두 개입니다. 정확도만으로는 아무것도 결론나지 않습니다. 짧은 배당의 강팀만 찍는 사이트는 70% 적중을 기록해도 돈을 잃을 수 있고, 우리는 이를 25,890경기에서 인기 AI tipster를 상세 분석하며 확인했습니다. 결론을 내리는 기준은 실제로 받을 수 있었던 배당의 손익분기율 대비 정확도이며, 그 다음이 closing line value입니다.
첫날 읽은 147개 예측 중 47개만 매칭할 수 있었습니다. 그건 그들의 실패도, 우리의 실패도 아닙니다. 이런 사이트들은 우리가 가격을 매기는 83개 리그보다 훨씬 많은 대회를 다룹니다. 우리가 커버하지 않는 리그에 대한 예측은 정직하게 점수화할 수 없으므로, 조용히 버리거나, 더 나쁘게는 패배로 처리하지 않고 따로 제외합니다.
이 패턴은 텔레그램 tipster audit에서도 확인했습니다. 46개 채널에서 공개 픽 1,279개를 읽었고, 그중 567개만 정산할 수 있었습니다. 측정 가능한 subset은 항상 공표된 기록보다 작습니다. 그리고 그 규모를 말하지 않는 audit는 검증을 요청하는 것이지, 검증을 받는 것이 아닙니다.
Statarea는 팁을 공개합니다. Zulubet은 홈, 무승부, 원정의 확률을 공개하고 가장 큰 값을 강조합니다. 대부분의 무료 사이트보다 한 단계 더 나아간 것이고, 더 엄격하게 검증할 수 있게 합니다.
확률은 반박 가능한 주장입니다. 예측자가 여러 백 번에 걸쳐 70%라고 말하면, 결과는 약 70%의 빈도로 나와야 합니다. 실제가 50%라면 그 숫자는 장식일 뿐입니다. 우리는 이제 Zulubet이 공개하는 모든 확률을 최종 결과와 함께 저장합니다. 시간이 지나면 그 페이지는 "closing line을 이기는가"뿐 아니라 "표시된 확률이 제대로 보정되어 있는가"에도 답할 수 있습니다. 같은 테스트는 우리 자체 model에도 적용하고 있으며, 참고로 그 모델은 market보다 더 나쁘게 calibrated된 것으로 드러난 뒤에 공개했습니다.
두 페이지는 데이터가 들어오는 대로 업데이트되며, 각 사이트당 최소 30개의 정산된 예측이 쌓이기 전까지는 판정을 보류합니다:
숫자가 어느 사이트에든 유리하게 나오면 그대로 말하겠습니다. 우리는 자체 손실 주간도 공개했고, 자체 model이 market보다 calibration이 나빴던 사실도 공개했으며, 측정 버그로 closing line value가 잠시 30포인트 부풀려졌던 일도 공개했습니다. 공개 측정의 의미는 결과를 우리가 고를 수 없다는 데 있습니다.
Method notes: predictions are read once per day from the sites' public pages with an identifying user agent; raw pages are archived privately and never republished. Fixture matching uses team-name normalisation with an alias table; unmatched picks are marked unverifiable and picks on uncovered competitions out of scope — neither counts as a loss. Price at detection is the best soft-bookmaker price we hold for that selection at read time. Closing line value = price at detection ÷ sharp closing price − 1 on the same market. We have no affiliation with, and no commercial relationship to, either site.