UFC 上海赛预测:我们的模型集体唱衰热门
在闫晓楠对阵丹尼斯·戈麦斯这场比赛上,我们的 AI 模型与博彩市场意见相左,并在 UFC 上海赛的 13 场比赛中有 8 场压低了热门的胜率。
我们的预测模型已经为UFC 上海赛的全部 13 场比赛打出了概率。其中有两场,它在谁会获胜这个问题上与博彩市场意见不同;而对这份赛程上几乎每一位热门,它都比市场要冷淡一些。
后面这一点才是更有意思的发现,所以在下结论之前,先把过程摆出来。
这两个数字分别是什么
模型会为每一场即将进行的 UFC 比赛的双方各给出一个获胜概率,这个概率基于我们的数据库重建,并且与实际签约的两位选手一一对应。市场那一列是独赢赔率换算成的隐含概率,并且剔除了博彩公司的抽水,因此一场比赛的两边相加正好是 100%,两边的比较才算同一口径。下面的赔率取自周四上午。
以下是这份赛程上的每一场比赛,模型概率对阵去抽水后的市场概率,均以排在前面的选手为准。
| 对阵 | 模型 | 市场 | 差值 |
|---|---|---|---|
| 乌马尔·努尔马戈梅多夫 vs 宋亚东 | 74.2% | 83.4% | -9.2 |
| 闫晓楠 vs 丹尼斯·戈麦斯 | 37.2% | 58.0% | -20.8 |
| 敖日格乐 vs 朝仓海 | 25.9% | 20.9% | +5.0 |
| 苏木达尔基 vs 亚历克斯·佩雷斯 | 60.2% | 66.4% | -6.2 |
| 刘策 vs 莱维·罗德里格斯 Jr. | 48.9% | 63.3% | -14.4 |
| 比拉尔·哈桑 vs 尼尔森·罗哈斯 | 62.4% | 85.8% | -23.4 |
| 纳姆斯莱·巴特巴亚尔 vs 安德烈·利马 | 27.7% | 30.0% | -2.3 |
| 鹤屋怜 vs 凯文·博尔哈斯 | 78.2% | 84.7% | -6.5 |
| 杰克·詹金斯 vs 肖恩·伍德森 | 41.8% | 42.9% | -1.1 |
| 肖龙 vs 弗朗切斯科·努齐 | 64.8% | 61.8% | +3.0 |
| 劳伦斯·雷 vs 赫克托·圣地亚哥 | 72.4% | 70.9% | +1.5 |
| 熊竞楠 vs 朱莉娅·波拉斯特里 | 41.5% | 31.6% | +9.9 |
| 丁猛 vs 卡姆·尼尔森 | 75.5% | 57.1% | +18.4 |
两处彻底相反的判断
闫晓楠(19-5)以 -150 的赔率成为对阵丹尼斯·戈麦斯(12-3)的小幅热门。她在女子草量级排名第四,在女子 P4P 榜上排名第十二;戈麦斯排名第十四。纸面上所有的排序信号都指向闫晓楠。
而模型认为戈麦斯有 62.8% 的胜率。
在一场排名选手之间的草量级对决上,这是与市场足足 20 个百分点的分歧,而且它不是样本太薄导致的四舍五入产物。闫晓楠 2018 年就进入 UFC,戈麦斯是 2022 年,两人都有足够真实的战绩供模型咀嚼。不管它读到了什么,它都是刻意这么读的。
另一处反转要安静得多。刘策以 -190 的赔率成为对阵莱维·罗德里格斯 Jr.的热门,而模型给出的是罗德里格斯 51.1% 的胜率。刘策的职业战绩是 3-1,罗德里格斯是 5-0,这正是那种市场按自己认得的名字定价、而模型按摆在面前的战绩定价的对阵。
照片: Новости ННТ / CC BY 3.0更大的规律在于压低热门
再看一遍差值那一列,数数其中的负数。13 场比赛里有 8 场,模型对市场看好的那位选手给出的概率低于市场,而且每一处超过 5 个百分点的压低,都落在赔率为 -150 或更短的热门身上。
这份赛程上差距最大的一场并不是那两处反转,而是比拉尔·哈桑对阵尼尔森·罗哈斯:市场给哈桑 85.8%,模型只给 62.4%。两人都保持不败,分别是 9-0 和 8-0。一位不败选手面对另一位不败选手却开出 -850 的赔率,等于市场在说它了解这两份战绩的成色;而对这两个人几乎无据可依的模型,则在说它并不了解。
这一点值得直说,因为它对本文的论点不利。一个从没见过某位选手在这个级别比赛的模型,会把他往中位数回归,而当你把结果印成表格时,往中位数回归和压低热门长得一模一样。这份赛程上差距最大的四场里有两场,刘策那场和排在前置赛最末端的丁猛那场,都牵涉到一位在我们数据库中职业比赛不超过 4 场的选手。
闫晓楠那场才是经得起这个反驳的一场。两位女将都已经在这个级别打了很多年,没有样本太薄这个借口可用,这也正是让它成为周六最值得盯住的那个数字的原因。
唯一一场模型更看好的比赛
熊竞楠是 ONE 的草量级冠军。2017 到 2025 年间,她在那个赛事出战 12 次,其中 9 次是世界冠军战。今年 5 月她迎来 UFC 首秀,以一致判定负于安吉拉·希尔。
市场把这一个结果看得很重:在前置赛对阵朱莉娅·波拉斯特里时,她是 +205 的冷门。模型给她 41.5%,比赔率宽厚了 10 个百分点。
10 个百分点算不上什么呐喊。它只是模型拒绝仅凭一个糟糕的夜晚就给 9 场冠军战重新定价,而这大致就是一套评分体系存在的意义。
然后就到周六了
我们已经拿结果对这些预测复盘了一段时间,最近的一次是萨克拉门托那场赛事,而诚实的总结是:这场比较里的任何一方都还没资格自鸣得意。市场非常强。模型偶尔更强,而且强在一个很具体的地方:在众人都很笃定的比赛上,它愿意大声地犯错。
闫晓楠在中国本土出战,排名比对手高出十位,而我们自己的模型认为她十次里要输六次。美东时间早上 6:00,我们两边总有一边会显得很傻。