Polymarket 年底最強 AI 模型市場:Google 反超 Anthropic,這個機率能當領先指標嗎?

Polymarket 年底最強 AI 模型市場中,Google 以 43% 小幅超越 Anthropic。本文說明結算看哪個排行榜、機率何時翻轉、交易量多少,以及數字能解讀到哪裡。

Share
Polymarket 2026 年底最強 AI 模型市場的一個月機率走勢圖,Google 43%、Anthropic 41%、OpenAI 7%
Polymarket Money 在 10 月 8 日貼出的市場走勢圖,顯示 Google 43%、Anthropic 41%、OpenAI 7%,累計交易量約 236 萬美元。圖片來源:Polymarket Money X 貼文 圖片來源:Polymarket Money(X 貼文附圖)。

10 月 8 日,Polymarket 旗下的財經帳號在 X 上發文說,Google 在「年底誰領先 AI 競賽」的賠率中超越了 Anthropic。

貼文附上的圖表顯示,Google 機率 43%,Anthropic 41%,OpenAI 只有 7%。這則貼文瀏覽數超過 46 萬。

預測市場是讓人用真錢買賣「某件事會不會發生」的平台。價格常被解讀成市場認為的發生機率。

不過這個市場賭的範圍很窄。它只看一個排行榜在 12 月 31 日中午那一刻的第一名。

我的判斷是,這組機率反映的是交易者對單一排行榜的預期,不能直接當成 AI 實力或公司價值的領先指標。

要理解 43% 代表什麼,得先看它怎麼結算。

這個市場賭的是什麼:Arena 排行榜的第一名

依預測市場資訊網站 DeFi Rate 整理的規則,這個市場看的是 Arena 文字排行榜的排名欄位。

Arena 原名 LMArena,做法是讓使用者比較兩個匿名模型的回答,再投票選出比較好的一方,系統依票數算出分數。

結算時間是美東時間 2026 年 12 月 31 日中午 12 點。排名同分時,再比 Arena 分數高低。

規則還指定要關閉「風格控制」。風格控制是 Arena 用來扣除回答長度與排版影響的調整,關閉後,這些因素對名次的影響就不會被扣掉。

交易者押注的是一個特定版本排行榜的年底快照。它只回答誰能在那個時點排第一,無法概括各家模型的整體能力。

那為什麼機率會在短時間內翻轉?

Polymarket 2026 年底最強 AI 模型市場的一個月機率走勢圖,Google 43%、Anthropic 41%、OpenAI 7%
Polymarket Money 在 10 月 8 日貼出的市場走勢圖,顯示 Google 43%、Anthropic 41%、OpenAI 7%,累計交易量約 236 萬美元。圖片來源:Polymarket Money X 貼文 圖片來源:Polymarket Money(X 貼文附圖)。

機率翻轉的時間點,和 Argon 亮相重疊

從貼文附的一個月走勢圖來看,9 月下旬 Anthropic 的機率大多在七成以上,Google 只有一成左右。

到了 9 月底,兩條線突然大幅靠近。Google 跳到四成上下,Anthropic 掉到五成左右,之後再慢慢交叉。

Google 正是在 9 月 30 日發表 Gemini 4 Argon。這款模型目前只開放給少數資安夥伴,一般開發者還不能使用。

但它已經出現在 Arena 上。Arena 文字排行榜頁面標示 10 月 8 日的資料中,gemini-4-argon-high 以 1525 分排第一,Claude Opus 5.5 以 1507 分排第二。

Argon 的分數旁邊標著「初步」,代表投票數還在累積。它目前約有 4,900 票,比前十名多數模型少很多。

這是頁面預設顯示的排名。市場結算用的是關閉風格控制的版本,兩種檢視的名次不一定相同。

機率變化和 Argon 發表時間重疊,但這張圖沒有分離其他消息的影響,不能直接證明是哪一則消息造成翻轉。要判斷訊號的分量,還得看交易狀況。

能當領先指標嗎?先看交易量與規則細節

貼文圖表上的累計交易量約 236 萬美元。10 月 11 日查詢 DeFi Rate 時,頁面顯示的 24 小時交易量約為 1,000 美元。

24 小時成交額反映的是那一天有多少交易,不能單靠它判定價格容易被推動。還需要看買賣報價間的差距,以及各價位有多少待成交的單。

貼文的 43% 對 41%,是 10 月 8 日的快照。到 10 月 11 日查詢 Polymarket 原頁時,Google 仍為 43%,Anthropic 已變成 42%,OpenAI 則為 10%。引用時必須連同日期,不能把不同時點的數字拼在一起。

排行榜本身也有範圍限制。Arena 衡量的是使用者對聊天回答的偏好,不等於寫程式或長任務的表現。

例如 Google 自己公布的比較表中,Argon 在 Terminal-bench 4.0 落後 Opus 5.5。排行榜第一和實際工作最好用,可能是兩回事。

同一頁的前十名裡,也有七個 Anthropic 模型。只要 Anthropic 在年底前推出新版本,第一名就可能再換人。

對使用 AI 的團隊來說,適合自己的工具仍要靠工作任務測試。客服回答、研究摘要與程式修改需要的能力不同,同一個聊天名次無法替這些需求做選擇。

若只是追蹤產業,這份賭盤可以用來觀察預期何時改變,再回頭找那段時間的公告與測試。它提供的是研究線索,不能代替查核模型的實際表現。

貼文另外把機率變化和 Anthropic 的上市計畫連在一起,這部分更需要拆開看。

和 Anthropic 上市扯上關係,要分開看

Polymarket 的貼文寫道,這個變化讓投資人在 Anthropic 上市前感到擔憂。財經帳號 zerohedge 也轉發,問這是不是急著在下個月上市的原因。

可查證的事實是,Anthropic 在 6 月 1 日宣布已向美國證管會秘密送交上市申請草案,但沒有公布上市日期與發行價格。

「投資人擔憂」是貼文的描述,沒有附上任何調查或資料。排行榜名次與公司營收、獲利也沒有直接關係。

把這個賭盤數字當成上市前的警訊,等於把一份聊天偏好排行榜,當成了公司的財務指標。

常見問題

預測市場的 43% 代表什麼?

代表當時押注 Google 的合約價格約 0.43 美元。它反映交易者的集體預期,不是任何機構的預測或保證。

為什麼還沒全面開放的模型能排第一?

Argon 雖然還沒全面開放,已經出現在 Arena 排行榜上。它的成績目前標為初步,票數增加後名次仍可能變動。

可以用這個機率判斷 Anthropic 上市的投資價值嗎?

不行。這個市場只看單一排行榜的年底名次,和公司營運沒有直接關係,本文也不構成任何投資建議。

結語

Polymarket 的機率翻轉,記錄了 Argon 發表前後交易者預期的變化。想追蹤 AI 競賽,直接看排行榜與各家的實際測試結果,會比看賠率更接近答案。

延伸閱讀:Gemini 4 Argon 正式亮相:現在誰能用、怎麼收費,值得先準備什麼?

延伸閱讀:OpenRouter 重磅數據揭秘:OpenAI 終結 Anthropic 長達 133 週統治!GPT-6 Astra 攜 19% 狂潮逆轉「錢包份額」王座,AI 開發者生態大洗牌深度解析

資料來源