Kimi、千问等AI集体押注世界杯⋯⋯大模型不再比拼聊天,为何集体扮演“懂球佬”?
2026-06-12 09:13 每日经济新闻
“世界杯预测无疑是展示模型与智能体水准的一个上佳机会窗口,不过预测的效果也是一把双刃剑。个人预期这届世界杯,水准最高的预测模型,成功率能达到60%~80%左右。”胡延平坦言。
不过,Kelly Bench在2023—2024赛季英格兰超级联赛的模拟中显示,其评估的每个前沿模型在整个赛季都亏损了,并且许多都经历了破产。其中,Claude Opus 4.7目前以-3.7%的平均投资回报率领先;有4个模型避免了所有的破产。
“AI更多是一个辅助工具,基于战队历史战绩、世界杯排名、赔率、国际足联等大量数据的多维度预测,AI大模型呈现了客观数据统计,所以作为参考工具还是有意义的,但不会完全依赖它的结果。”一位长期关注世界杯的资深球迷告诉每经记者。
在上述球迷看来,相比大模型的预测,每个球迷都更青睐自己喜欢的球队,喜好也会占一大部分判断,而且越到决赛越是球员临场发挥和心理上的博弈,不确定性太多了。
不再比谁更会“聊”
押注世界杯背后AI们集体想拼什么?
当Kimi拿出万亿Token、调动300个子Agent对世界杯赛事进行并行预测,当千问、豆包、元宝争先恐后地给出各自的夺冠热门队伍时,这场看似娱乐化的“AI押注战”背后,AI大模型厂商究竟想“秀”什么?又在集体“卷”什么?
“本轮大模型预测世界杯冠军,是生成式AI从问答工具走向公共事件运营的典型样本。”王岩向每经记者指出,公众看到的是冠军预测,企业展示的则是Agent协同、长上下文处理、实时检索、概率解释和高并发服务能力,商业上争夺的则是用户时长、付费转化和资本叙事。




