人機大戰決賽成績單亮相:AI預測世界盃,真正該預測什麼?
北京時間7月20日淩晨,2026年美加墨世界盃落下帷幕。加時賽第106分鍾,尼科·威廉斯頭球擺渡,費蘭·托雷斯禁區爆射破門,西班牙1:0絕殺阿根廷,時隔16年再度捧起大力神杯。

這不僅是本屆世界盃的最終結果,也是聯想集團與咪咕視頻聯合發起的《世界盃預測人機大戰》最後一題的標準答案。時間回溯到7月19日晚9點,在《人機大戰:誰是世界盃預言家》錄製現場,一場被節目組標註為最高難度“S+”的對決擺在了三位嘉賓和兩款AI面前。
顏強壓上全場最高的5700腦力值,判斷阿根廷與西班牙1:1言和;閻鶴祥則看好阿根廷2:1小勝;孫繼海認為雙方會打出2:2大比分平局。輪到AI,千問和智譜難得意見一致,都給出阿根廷2:1取勝的判斷。三個人,兩款大模型,五份預測,沒有一份寫著“西班牙1:0”——連同所有觀眾的猜測,也一起翻了車。而當晚不在鏡頭前的另外十款參賽AI,同樣未能命中最終比分。
當塵埃落定,一張從未在產業界出現過的“AI能力真實成績單”,終於被公之於眾。一場持續39天的人機大戰公開賽落幕,12款國產大模型在104場真實賽果中完成了人類曆史上第一次大規模、連續性、可被公眾監督的AI能力檢驗。但比冠軍歸屬更值得回答的問題是:AI真正的價值,究竟是把冠軍猜對,還是讓世界盃成為一屆“真正由AI驅動運轉的世界盃”?
決賽時刻:一場“全員翻車”里的1/12
如果說小組賽階段12大AI還能依靠數據穩定輸出,那麼這場世界盃決賽,則讓所有模型集體陷入“判斷癱瘓”。
決賽前,12個AI的答案分成三組:DeepSeek、百度文心和Kimi預測1比1;千問、騰訊混元、智譜和商湯小浣熊預測阿根廷2比1勝;中移九天、聯想天禧AI、MiniMax和訊飛星火預測西班牙2比1勝,階躍給出了西班牙4比3勝的比分。
90分鍾結束時,比分卻是0比0。加時賽把最終賽果改寫為西班牙1比0。按照人機大戰統一以120分鍾賽果結算的規則,5個AI命中勝平負方向,精確比分則全數落空。
比單場勝負更難的,是冠軍預測。它要求模型不僅判斷一場比賽,還需要同時穿過整個淘汰賽路徑。冠軍競猜開啟時,巴西得到DeepSeek、千問、騰訊混元、Kimi和訊飛星火支持;法國得到中移九天、百度文心、MiniMax和階躍支持;智譜與商湯小浣熊選擇阿根廷;聯想天禧AI獨自選擇西班牙。
隨後,巴西在1/8決賽被挪威淘汰,法國在半決賽負於西班牙,阿根廷一路走到決賽,卻也倒在西班牙面前。三個更熱門、更擁擠的答案相繼出局,最後留下來的,是開賽前並不被多數模型所看好的西班牙。

12個AI里,只有聯想天禧AI把冠軍票投給了西班牙。而此前32強晉級預測中以31/32超過所有AI的重慶貼磚哥,也選擇了西班牙。一個是12個AI中唯一押中冠軍的模型,一個是32強預測中超過所有AI的普通球迷。終場哨響,他們等到了同一個名字。
這也說明,足球比賽中始終存在大量難以量化的臨場變量。縱觀整屆世界盃,淘汰賽末段的絕殺、紅牌減員、門將神撲、球星臨場發揮、戰術變陣……這些不可量化的臨場變量,成為AI在決賽舞台上的最大難題,任何一個瞬間都能輕易改寫走向,即便擁有多年行業經驗的評論員、依託海量數據運算的人工智能,也無法百分百精準預判結局。
但決賽“全員翻車”,並不意味著這場AI公開賽是失敗的。正因為預測充滿不確定性,才讓接下來這份“39天全景成績單”顯得異常珍貴。
39天全景成績單:12大AI的真實競技
截至104場全部結束,12大AI的最終成績單出爐。
千問與中移九天均命中72場,以69.2%的勝平負命中率並列第一;騰訊混元與聯想天禧AI均命中71場,以68.3%並列第三;商湯小浣熊70場,智譜69場,DeepSeek 67場,訊飛星火與百度文心各66場,Kimi與MiniMax各63場,階躍則以55場墊底。全部104場比賽中,12個AI累計猜中805次勝平負,整體命中率64.5%;精確比分命中151次,命中率12.1%。

相較於單純的排名,這份成績單更值得關注的,是不同模型呈現的能力差異。
雖然千問與中移九天並列勝負榜首,但中移九天以17次精確比分命中,成為全場“比分最準”模型。天禧AI的特殊價值在於“全程不掉隊”——賽前32強預測、72場小組賽、32進16淘汰賽、前100場累計總榜,四個關鍵節點全部進入前四,是唯一做到這一點的模型。如果把12個AI類比成球隊,它們交出的不只是12份答卷,更像是12套不同的“戰術體系”:有的擅長穩控全程,有的依賴階段性爆發,有的更頻繁調整答案,有的則明顯偏好平局。
這場實驗最戲劇性的發現,不是AI最終贏了多少,而是AI在開賽第5天就完成了逆轉。6月13日開賽首日,AI命中率43.8%,人類54.4%,AI落後10.6個百分點。僅僅5天后,6月18日,AI升至48.6%,人類降至45.0%——AI首次反超,形成“黃金交叉”。
此後AI整體保持領先,到7月12日第100場時,AI命中率達到65.7%,人類為58.9%。AI贏下的不是某一次的“神預測”,而是長賽程中的平均穩定性,當球隊狀態、陣容變化、積分形勢等結構化信號逐漸豐富,AI的整合能力更容易顯現。它未必能猜中每一次絕殺,卻更可能在持續、多輪、重複性的判斷中抬高平均線。

從Prediction AI到Operation AI:AI真正的價值不止於此
39天的考試,讓外界看到,Prediction AI有其不可替代的價值。
它讓4200萬用戶與12款大模型共同參與一屆世界盃,讓AI第一次在如此長週期內被公眾持續驗證,讓“模型的判斷力”變成可被全民監督的公共數據。它製造話題、吸引眼球、形成討論,這些本身就是AI走向大眾的重要一步。聯想與咪咕發起的這場人機大戰,恰恰是Prediction AI最好的舞台。
但Prediction AI的價值邊界也清晰可見:它擅長抬高平均線,卻不擅長消除偶然性;它能在長賽程中形成穩定優勢,卻在平局、冷門、決賽等偏離常規的場景中承壓。這不是Prediction AI的失敗,足球本身就是一項拒絕被完全計算的運動。問題在於,如果我們只把AI的核心價值錨定在“預測冠軍”這一件事上,就可能忽略了AI在體育產業中更大的可能性。
彭博社曾以《中國人工智能企業的最新戰場:世界盃預測》為題關注這場實驗。但更值得關注的是這篇報導中的潛台詞:如果“預測”只是AI的入口,那麼真正的賽場,在“預測之後”。
作為FIFA官方技術合作夥伴,聯想集團在本屆世界盃形成了兩條彼此連接的AI實踐路徑。一條在賽場之外——與咪咕聯合發起世界盃預測人機大戰,讓AI走到公眾面前接受真實檢驗;另一條在賽場之內——AI不負責預測冠軍,而是承擔保障世界盃賽事真實運行的“技術底盤”角色。
在賽場內,聯想自研的FIFA AI Pro世界盃足球AI超級智能體將曆史數據、比賽信息、圖像、視頻和戰術分析組織為可調用的智能洞察,為教練、球員和分析師提供快速、定製化的備戰支持;3D數字人可視化方案幫助觀眾更直觀地理解越位判罰;裁判視角AI視頻增強系統通過防抖和畫質增強,讓全球觀眾更穩定地從裁判第一視角接近賽場;聯想技術所支持的國際廣播中心、賽事運營中心與技術指揮中心,則共同服務這屆規模空前的賽事運行。

決賽第93分鍾恩佐·費爾南德斯累計兩張黃牌被罰下、加時賽下半場托雷斯完成絕殺——這些讓所有AI模型集體翻車的“臨場瞬間”,恰恰是Operation AI登場的主場。
一次越位判罰,可以通過3D數字人可視化方案以毫秒級精度還原給全球數億觀眾;一次紅牌出示,可以借助裁判視角AI視頻增強系統第一視角畫面無抖動無模糊,讓爭議止於事實;一支球隊的備戰,可以通過FIFA AI Pro在數秒內響應教練的自然語言提問,調取曆史錄像、戰術圖表,甚至生成3D虛擬球員進行模擬推演;整個賽事的信號轉播、票務、安防和應急,可以由智能指揮中心統一調度,讓容納數萬人的體育場平穩運轉。
如果說Prediction AI讓AI走向大眾、形成討論,那麼Operation AI讓AI走向產業、形成價值。前者拚的是大模型的語料規模與推理能力,後者拚的是端側算力、基礎設施和工程化能力。前者回答誰會贏,後者回答怎樣讓世界盃順利完成。其它企業做的是Prediction AI,聯想更擅長的是Operation AI——這不是一句口號,而是兩套完全不同的能力棧。
AI沒有成為預言家,但AI重塑了世界盃
這場39天的實驗已經給出了比“AI贏還是人類贏”更值得討論的答案。AI真正的價值,從來不是預測誰奪冠,而是幫球隊推演下一場戰術,幫裁判減少一次誤判,幫助轉播機構呈現更穩定的賽場畫面,也可以讓一座體育場、一屆大型體育賽事更加高效平穩地運轉。
當最後一場比賽的終場哨響起,冠軍會被寫進曆史,所有預測也會迎來最終結算。但比榜單更值得留下的,是人類第一次如此大規模地與多個AI共同觀看同一屆世界盃,共同作答、共同等待,也共同接受足球給出的答案。與此同時,當AI開始支撐一項全球最大規模體育賽事穩定運行時,它的價值,已經不再是猜對一場比賽,而是成為賽事本身的一部分。
十年前,AlphaGo讓公眾看見AI如何在封閉規則中挑戰人類頂尖棋手;十年後,世界盃讓公眾看見AI如何走出實驗室,進入真實世界,從預測冠軍,到保障賽事,從回答問題,到支撐運營。預測不是終點,從預測走向驗證,從答案走向解釋,從技術展示走向公眾參與——對於AI產業而言,這才是“首屆AI世界盃”留下的獨特體驗。
所以,AI預測世界盃,真正該預測什麼?或許不是誰會捧起大力神杯,而是下一項會被AI重新定義的工作、下一種會被AI重構的產業,以及下一場正在發生的智能化變革。冠軍終將屬於一支球隊,而推動產業智能化,才是AI真正的價值所在。

















