一个模型,四个盘口
每一条预测都从 Dixon–Coles 模型开始。它估计每支球队进球和防守的强度,为主场优势做出调整,产出一整张比分概率网格——0–0、1–0、2–1 等等各自的可能性。赛果、大小球、双方是否都进球、正确比分,全都从这一张网格上读出。这也是它们彼此始终一致的原因:它们是同一幅底图的不同视角。
为什么近期比赛权重更高
一支球队不会年复一年一成不变——球员、教练、状态都在变。所以模型给近期比赛比旧比赛更高的权重,让久远的过去逐渐淡出,而不是把五年前的一场结果当成昨天的来算。过去淡出的快慢不是拍脑袋定的;它是在逐周回测上调出来的——在那里我们能看清哪种设定当初预测得最好,同时始终不让模型看到未来。
初入新联赛的球队
刚升上来的球队在新级别没有近期战绩,模型无法直接判断它。它先用可比球队——强度相近的那些——的平均值作为这支队的起点,随后让球队自己的比赛结果逐渐接管。大约十场之内,真实证据就取代了起始假设。这些球队的早期预测带着更多不确定性,而这份不确定性本就应该在。
为什么我们不宣称战胜博彩公司
这是我们能对你说的最直白的一句话:WinSight 不宣称能战胜博彩公司,而且你应当警惕这个领域里任何这样宣称的人。等一场比赛开球时,博彩市场几乎已吸收了关于它的一切可知信息——阵容、伤停,以及真金白银把价格推向真相的力量。收盘赔率是这项运动里最锐利的预测,没有任何公开模型能稳定战胜它。在完全相同的 16,322 场比赛上,我们诚实的逐周回测,准确率落后 Bet365 收盘热门 2.16 个百分点。这个差距我们选择公示,而不是藏起来。
那么 WinSight 为的是什么?为的是对自身不确定性诚实的概率,以及一份公开、永久、从不删改的记录——包括我们算错的那些预测。那份记录,是任何一个口气笃定的贴士党永远拿不出来的东西,也是我们唯一请你用来评判我们的东西。
如何读懂一个概率
60% 的可能性不是承诺。它意味着:如果同样的情形重演很多次,我们预期它大约十次里发生六次——这也意味着它大约十次里该有四次不发生。一条高信心预测走反了,不代表模型坏了;一个"60%"只有四成兑现的模型,才是坏了。这两者之间的差别,正是校准所衡量的,也是我们为什么公示校准曲线、而不只给一个表面准确率数字。请把这些概率读作对不确定性的审慎估计,而不是对"必然发生什么"的预告。