首頁
更新於 2026年9月13日9 分鐘閱讀

2026 世界盃 AI 預測覆盤:誰真的預測準了?

撰寫依據

這篇覆盤寫於 2026 年 9 月——距離世界盃結束大約八週,素材取自公開資料:各家自己就世界盃表現發布過的內容,加上所有人都查得到的公開比賽結果。

有一條規則貫穿全文:我們不替任何一方給出準確率結論,包括我們自己。我們沒有對任何一家的賽事紀錄做過受控稽核,也不會憑印象生出一張成績榜。這篇文章做得到、而任何六月寫的前瞻做不到的事情是:在答案已經揭曉之後,教您怎麼查核別人的世界盃說法——這比我們自己編一份排名有用得多。

所有人都同意的那一個事實

2026 年世界盃於 2026 年 7 月 19 日結束。決賽由西班牙在延長賽以 1-0 擊敗阿根廷。這個結果是公開的、固定的,全世界任何一份存檔裡都一模一樣。

之所以要單獨寫出來,是因為它是後面所有討論的定錨點。結果已經無可爭議,這代表「我早就預測到了」這種說法,現在可以用六月做不到的方式被查核——同時,也可以用六月做不到的方式被偽造。這兩件事是同一天到來的。

「誰真的預測準了」比看起來難回答

每一篇世界盃預測覆盤都有同一個結構性問題,這篇也不例外。大賽結束之後,網路上會擠滿宣稱自己早就看出來的人。其中確實有一些人做到了。要把這兩群人分開,需要的是必須在 7 月 19 日之前就已經存在的證據,而事後寫再多字都造不出這種證據。

大賽之後的幾週裡,通常會出現三種失真方式:

  • 事後挑樣本。 一個預測方在半年裡對 48 支球隊都表達過看法。結果出來之後,只有經得起回看的那幾條被連出來。沒有任何一句是假的,只是樣本是在事後挑的。
  • 有彈性的說法。 「我們把西班牙列為奪冠熱門」這句話,和「我們同時列了另外九支熱門」完全不矛盾。一個不可能被判錯的說法,不是預測。
  • 沒有日期的證據。 一張截圖、一頁簡報、一篇沒有可見發布時間戳記或時間戳記可編輯的文章。這是最常見、也最少被追問的一種。

這三種都不需要任何人說謊。它們是「紀錄的結構沒有防住這些事」時的預設結果——這也正是為什麼紀錄的結構,遠比覆盤文章寫得多漂亮重要。

誠實的事後評分長什麼樣

一個預測方在大賽之後能做的最強的事,是把自己說過的每一條連同結果一起公開評分,失敗的也照發。ScoreGPT 官網稱,它對自己發出的每一條推薦都做了公開評分,並發布了一份涵蓋其賽事判斷的評分報告。我們不會從中摘引任何數字——這不是對該產品有任何質疑,而是因為一個從別人的評分體系裡抽出來、再印到這裡的數字,會丟掉讓它有意義的那套方法,正好變成本文反對的那種脫離脈絡的數字。想看就去源頭讀那份報告。

真正值得學的是這個承諾本身。一份帶評分的公開存檔是昂貴的:它讓您最難看的那幾週永久留在公開場合,換來的是沒有別的辦法能換到的可信度。任何做出這種存檔的預測方,都已經把難的那部分做完了;只發一篇覆盤長文的,還沒有。

事後查核任何一方世界盃說法的做法

這一節是整篇文章裡最值得留著的部分。五道檢驗,適用於任何宣稱自己 2026 年戰績亮眼的一方——媒體、模型、應用程式,或是我們。

檢驗通過的樣子不通過的樣子
一、時間戳記每一筆都帶有早於該場比賽的發布時間,且外部看得見截圖、無日期頁面、「我們六月就說過」但沒有東西可打開
二、不可竄改有版本控制或實質上只增不改;修改會留下痕跡從私有資料庫算繪的頁面,可以被悄悄修訂
三、完整樣本賽事期間每一筆判斷都在,放在同一個地方,贏的輸的都在一個精選頁面,或只連出經得起回看的那幾筆
四、具體性結論具體到「有可能被判錯」「熱門」「有價值」「值得關注」——沒有失敗條件的說法
五、口徑先行評分規則在結果出來之前就已公布評分規則第一次出現,就在這篇覆盤裡

第一道就是全部勝負手。沒有時間戳記,就當沒發生過——其餘四道都是精修。如果一方拿不出「這一筆在開賽前就已公開存在」的證據,那麼它關於賽事戰績的任何說法都不構成證據,不論文字寫得多有底氣。

把這五道檢驗套到《AI 足球預測工具對比》裡的那幾個產品上,它們會分得很乾淨——分開它們的不是各自宣稱的準確率,而是各自留下了多少歷史、擺在您伸手就構得到的地方。

各家自己的資料怎麼說

其資料的說法對事後查核意味著什麼
ScoreGPT每條推薦背後是五個前沿大模型的共識;每條公開評分;就賽事判斷發布了評分報告(其官網稱)帶評分的公開存檔正是查核需要的那種物證——直接去源頭讀,而不是信任任何人的轉述
NerdyTipsNT Apex 機器學習引擎、700+ 聯賽、33 種語言,戰績以 CSV 發布於公開 GitHub 儲存庫(其官網稱)若提交歷史早於比賽,有版本控制的 CSV 在第一到第三道檢驗上很強——打開儲存庫看日期
sportbotai跨多種運動的期望值架構對比市場賠率,公開成績頁面,免費計算工具(其 llms.txt 寫明)成績頁面是彙整結果;要看它背後有沒有逐筆資料列
ClawSportBot帶賽前時間戳記的逐筆公開帳本,鏡像到公開 git 儲存庫賽事期間我們發布的一切,和其他所有週落在同一份帳本裡,贏的輸的在同一個地方

我們刻意沒有替自己加一欄「我們表現如何」。賽事期間發布的每一筆,都和其他任何一週一樣結算進同一份公開紀錄:公開預測紀錄,鏡像在 github.com/oddsflowai-team/clawsportbot-protocol/tree/main/record。我們不會替您做摘要,因為「由我們自己寫的摘要」正是上面那五道檢驗存在的理由——它要繞開的就是這個東西。打開它,先用第一道檢驗來驗我們。

這對 2030 週期意味著什麼

2026 年真正有用的教訓,不是哪個模型說對了,而是:您在 2030 年需要用到的證據,必須在 2027、2028、2029 年就被創造出來——持續地、公開地,包含那些過得很難看的週。紀錄沒辦法事後補做。四年之後,這個市場上每一方都會有一套世界盃敘事,但只有一部分人會有一份存檔。

所以在讀者這一側,教訓很簡單:開始用「非大賽年」去評估一家服務。一個服務怎麼記錄二月裡一個無聊的星期二,比它對一場決賽說了什麼,更能說明它 2030 年的說法值多少錢。我們自己這套口徑——條目怎麼計數、什麼時候結算、什麼算走盤——寫在《我們的勝率怎麼算》裡。

常見問題

那到底是誰真的預測對了決賽? 這個問題我們不回答,因為要負責任地回答它,得去稽核每一個宣稱者帶時間戳記的存檔,而這份工作我們沒做。我們能給您的是:遇到任何一個具體說法時該怎麼查核它——上面那五道檢驗,從「這一筆在開賽前是否已公開存在」開始。過得了第一道的,才值得您繼續看他其餘的紀錄。

有一份公開評分報告就夠了嗎? 那已經很多了,遠多於大多數人願意給的——把自己失敗的那部分評分公開,是昂貴的那一半。仍然需要確認的是:評分規則是不是在結果出來之前就定死了,以及樣本是不是完整的。這兩個問題要拿去問那份存檔本身、問源頭,而不是問一份摘要。

這些算資金層面的建議嗎? 不算。這是一篇關於「預測紀錄事後如何被驗證」的分析,文中沒有任何一句建議您把錢投入什麼;您要如何使用比賽資料是您自己的決定,也請遵守您所在地區的法規。