AI猜中了勝負,卻沒猜中世界盃:12個AI、明星嘉賓、貼磚小哥同場交卷,真正贏下這場”考試”的,是足球

一、16強落定,AI交卷

7月4日,曆時六天、十六場生死戰之後,2026年美加墨世界盃16強名單終於落定:加拿大、巴西、巴拉圭、摩洛哥、挪威、法國、墨西哥、英格蘭、比利時、美國、西班牙、葡萄牙、瑞士、埃及、阿根廷、哥倫比亞。

這是世界盃曆史上第一次出現“1/16決賽”。48支球隊、104場比賽的新賽制,把淘汰賽的閘門提前了一輪,也把偶然性放大了一輪。六天之內,東道主三國攜手過關,德國與荷蘭兩大豪門同日被點球放逐,佛得角把衛冕冠軍阿根廷拖進加時,直到最後時刻才被擊倒。

球場之外,另一場比賽也在同步計分。

聯想集團與咪咕視頻發起的“世界盃預測人機大戰”中,由聯想天禧AI召集的12個中國主流大模型——聯想天禧AI、DeepSeek、通義千問、百度文心、騰訊混元、Kimi、智譜、MiniMax、階躍星辰、訊飛星火、商湯小浣熊、中移九天——對這16場比賽交出了整整192次預測。

成績單是這樣的:勝平負方向,192次預測命中132次,命中率68.8%;精確比分,192次預測命中41次,命中率21.4%。

這不是一個低分。恰恰相反,它說明AI已經相當擅長判斷強弱、趨勢和大概率結果。但這張成績單里最值得看的,不是132次命中,而是剩下的60次失手。

那裡面,藏著足球不肯被完全計算的部分。

二、兩個0/12:算法最整齊的一次失手

這一輪12大AI預測,有兩個“0/12”。

德國對巴拉圭。12個AI,12張預測卡,無一例外寫著“德國勝”:2:1、3:0、3:0、2:0、2:0、3:1、3:1、3:0、3:1、2:0、3:0、3:1。

這不是荒唐的判斷。四屆世界盃冠軍,對陣南美中遊球隊;更深的陣容,更穩定的淘汰賽經驗,更顯赫的曆史。按常識、按數據、按概率,這都是一道不難的題。

但比賽沒有按概率走。

120分鍾1:1,點球大戰巴拉圭晉級。德國出局。12個AI,12次預測,全部落空。

同一個比賽日,荷蘭對摩洛哥幾乎複刻了這一幕。12個AI同樣全部預測荷蘭勝,比賽同樣踢成120分鍾1:1,同樣進入點球大戰,同樣是傳統強隊倒下。

兩場比賽,24次預測,0次命中。

AI不是敗給了無知,而是敗給了共識。它們讀懂了曆史,讀懂了實力,也讀懂了概率,卻沒有讀到點球點前那幾秒鍾的遲疑、門將撲出去的一瞬間,和淘汰賽里某支球隊突然相信自己可以改寫命運的衝動。

所有讓世界盃成為世界盃的時刻,幾乎都發生在概率的邊緣。

三、猜中勝負,卻錯過了比賽的形狀

如果只講失手,也是不公平的。

16場比賽里,有八場12個AI全部命中方向:巴西勝日本、法國勝瑞典、英格蘭勝剛果(金)、美國勝波黑、西班牙勝奧地利、葡萄牙勝克羅地亞、瑞士勝阿爾及利亞、阿根廷勝佛得角。對“大概率之河”的把握,AI是穩定而有效的。

問題在於,足球最迷人的部分,往往不只在結局。

AI算得出英格蘭會贏剛果(金),卻算不出凱恩會在第86分鍾用一腳時速94公里的轉身抽射完成逆轉,順手超越貝利的世界盃進球紀錄;算得出加拿大是熱門,卻算不出歐斯塔基奧要等到第92分鍾,才為這個國家射進隊史第一個世界盃淘汰賽進球。

阿根廷對佛得角,則是最典型的樣本。

賽前,12個AI全部預測阿根廷勝,方向完全正確。但真實發生的比賽,不是一場輕鬆的大勝,而是90分鍾1:1、加時3:2。阿根廷兩度被追平,佛得角把衛冕冠軍拖到最後時刻,直到第111分鍾才被一次折射擊穿。

AI猜中了勝負,卻錯過了比賽的形狀。

最終,千問和中移九天以13/16、81.3%的方向命中率並列領跑;MiniMax雖然方向命中為12/16,但精確比分命中6場,比分命中率達到37.5%,在比分維度最突出;此前在32強預測中領跑的騰訊混元,本輪只命中9場,與Kimi、訊飛星火同列後段。

預測的王座不是固定的。上一輪領先,不代表下一輪繼續領先。世界盃每一輪都是新考卷,上一張卷子的高分,換不來下一場比賽的豁免。

這場實驗最誠實的是,它不是為了證明某一個AI永遠更準,而是把所有模型放到同一個賽場上,讓它們一次次接受真實賽果的校驗。

在一個由紅牌、門柱、點球和第92分鍾組成的世界里,任何領先都是暫時的。

四、從貼磚工到12個AI:世界盃仍然不可完全計算

這個夏天至今最強的預測者,也許不是任何一個AI。

在此前的32強競猜中,一位來自重慶彭水的29歲家裝貼磚工李先生,在超過2500萬參與者中猜中了31個晉級名額。12個AI、解說名宿、明星嘉賓同場作答,他的成績依然高得驚人。

這當然不能證明人類直覺一定勝過AI。它只能說明,在世界盃這樣的系統里,計算和直覺都只能接近答案,卻很難完全占有答案。

從2010年的章魚保羅,到今天的超級計算機和大模型,人類從來沒有停止過對“預知比賽”的迷戀。只不過,過去我們把期待寄託在一隻章魚身上,現在則寄託在算法、模型和算力上。

而中國這場“世界盃預測人機大戰”不是一台機器或是AI的獨角戲,而是12個大模型與數千萬普通用戶、專業嘉賓一起交卷。AI不再只是替人類做判斷的黑箱,它坐到了人類旁邊,寫下自己的答案,接受同一記終場哨的裁決。

這可能才是“首屆AI世界盃”的真正含義:不是AI預測世界盃,而是世界盃考驗AI。用點球,用補時,用一個40歲門將的十次撲救,用一支不被看好的球隊突然爆發出的勇氣。

16強之後,新的對陣已經排開。12個AI很快還會交出下一輪預測。它們大概率會繼續保持不錯的命中率,也大概率會在某個夜晚再次集體失手。屏幕前的人也一樣,會繼續熬夜,繼續相信自己比機器更懂某支球隊。

多數時候,我們錯了。

偶爾,像那位重慶的貼磚工人一樣,我們對得離譜。

68.8%屬於算法。剩下的31.2%,屬於點球點,屬於補時,屬於門柱,屬於一個不肯倒下的門將。

也屬於足球,屬於我們熬過的每一個夜晚。