1つのモデル、4つの予測
すべての予測はDixon–Colesモデルから始まります。各チームの得点力と失点を防ぐ力を推定し、ホームアドバンテージを調整して、0–0、1–0、2–1などのスコア確率を網羅したグリッドを作ります。試合結果、オーバー/アンダー、両チーム得点、正確なスコアは、すべて同じグリッドから読み取ります。互いに矛盾しないのは、同じ全体像を別の角度から見ているためです。
直近の試合を重く見る理由
チームはシーズンごとに同じではありません。選手、監督、調子は変化します。そのためモデルは古い試合より直近の試合を重く扱い、5年前の結果を昨日の試合と同じにはせず、遠い過去を徐々に薄めます。薄まり方は推測ではなくウォークフォワード・バックテストで調整し、未来を見せずに当時最も良く予測できた設定を選びます。
新しいリーグに入ったチーム
昇格チームには新しいディビジョンでの直近記録がないため、モデルはすぐに直接評価できません。まず強さの近いチームの平均を初期値とし、実際の結果が加わるにつれて、そのチーム自身のデータへ置き換えます。およそ10試合で実データが初期仮定を上回ります。序盤の予測にはより大きな不確実性があり、それは意図されたものです。
ブックメーカーに勝つと主張しない理由
最も明確に伝えられることがあります。WinSightはブックメーカーに勝つとは主張しません。この分野でそう主張する人には注意が必要です。キックオフまでに市場はチーム情報、負傷、実際の資金が価格を真実へ近づける力など、知り得るほぼすべてを織り込みます。締切オッズはサッカーで最も鋭い予測であり、公開モデルで安定して上回るものはありません。同じ16,322試合で、私たちの正直なウォークフォワード・バックテストはBet365の締切時本命より的中率で2.16ポイント下回ります。その差を隠さず公開します。
ではWinSightは何のためにあるのか。不確実性に誠実な確率と、間違えた予測も含めて公開され、永久に残り、編集されない実績のためです。その記録は自信ありげな予想屋が示せないものであり、私たちを評価する際に唯一見てほしいものです。
確率の読み方
60%は約束ではありません。同じ状況が何度も起きれば、10回に約6回起き、約4回は起きないと期待する、という意味です。高信頼度の予測が1度外れてもモデルが壊れているとは限りません。60%とした事象が40%しか起きないモデルなら問題です。その違いを測るのが確率校正であり、見出しの的中率だけでなく校正曲線を公開する理由です。確率は必然の予告ではなく、不確実性の慎重な推定として読んでください。