在場的各位都是 ____,Anthropic 推出最強模型 Fable 5

Share
在場的各位都是 ____,Anthropic 推出最強模型 Fable 5

上週是我目前 Computex 生涯裡最狼狽的一次。

GTC Taipei 的前一天我生病了,結束後帶著 39 度的高燒從台北開車回林口,那應該是我這輩子開過最危險的一段車,當時真的應該直接叫 Uber 去看醫生的。也因為這樣,我的 Computex 行程全都壓在下半場。但難得來了,我決定挑戰一個自己平常根本不會碰的主題:能源、電力、資料中心。

先打個預防針:我不是電力工程師,也不是金融分析師。我只是一個每天在用 AI、偶爾分享怎麼用 AI 的人。所以這篇文章不會有很深的技術分析,但我可以告訴你我「為什麼覺得這件事值得花一個下午去聽」。

我印象很深刻的是,前年年底 Satya Nadella 接受訪談時提到,他們手裡有一堆GPU,有 RAM,有一堆準備好的硬體,但問題是資料中心根本來不及蓋好,然後也沒有電,這些硬體就單純買來放在那邊,因為沒有任何地方可以插進去。

但你知道嗎,這件事過去了一年半了,事情並沒有解決。高盛在最近的報告裡更新了他們的預測:全球資料中心電力需求,到 2030 年將比 2023 年暴增 220%,總用電量將達到 1,350 TWh,相當於「整個日本的年用電量」(一個國家一整年的電量,因為數字實在太誇張,要重講一次)。

他們也指出,未來一到兩年內,美國原定要開張的資料中心,預計只有 50–60% 能夠準時上線,其餘的都面臨延誤或取消。就連 OpenAI 宣佈要砸 5,000 億美元的 Stargate 計畫,在德州的進度也已經落後原定時程。

所以帶著這個問題的我,特別去聽了兩場論壇,整理出兩點大的 Takeaways:

Takeaway 1:兩百戶家庭的尖峰用電量,如何塞進 NVIDIA 在 GTC 展示出來的機架

如果你有看今年 GTC 的報導,應該看過 Jensen 在台上展示的 NVIDIA 最新 GB200 機架,而這個機架要怎麼供電,就是我的第一個問題。

NVIDIA 800 VDC Architecture Will Power the Next Generation of AI Factories

這場的演講者是德州儀器 Kilby Labs 的 VP 暨研發主管 Dr. Jeff Morroni。Kilby Labs 有點像是他們的未來研究院,從這個層級的人出來談資料中心供電,明顯不是在推產品,而是分享他們認定接下來十年最核心的研究戰場。

根據 Morroni 的說法,現在的 AI 機架已經來到 100 千瓦,下一代 AI 機架正在朝百萬瓦推進,而這相當於 200 棟冷氣開好開滿的房子的總用電量,裝進一個冰箱大小的鐵櫃裡

傳統資料中心的供電標準是 48V。電功率等於電壓乘以電流,意思是:電壓固定,要送出越大的功率,你就需要越大的電流。電流越大,電線就必須越粗,才不會過熱或白白燒掉電。

所以為了安全地傳這個電流,你需要的銅排(銅線)粗到接近你的手臂,加總起來重達 450 磅,而機架就這麼大,450 磅的銅線基本上就已經把整個機架塞滿了,晶片無處放。

解法說起來非常簡單:把電壓拉高十六倍,電流就少十六倍,電線從手臂粗變成手指粗,空間省出來了,熱也少了。這就是 800V 直流電(800VDC)架構的核心邏輯。

Takeaway 2:資料中心的「數位轉型」?蓋不出來,那我們就翻修

Schneider 是全球最大的資料中心電力基礎設施廠之一,新的機房要蓋、舊的機房要撐,兩邊他們都在做。他在台上要大家想像一個畫面:一個兩公尺高的機架鐵櫃,裡面要同時塞 GPU、供電設備、散熱設備三種東西。GPU 越強、越耗電,供電和散熱需要的空間就越多,但機架沒有變大。

那些支援算力的東西,正在擠壓算力本身的空間。這個矛盾在 AI 之前幾乎感覺不到,現在已經是設計資料中心最頭痛的問題之一。

那怎麼解?他說了一句話讓我印象很深:「不要把這場轉型想成一個按鈕,按下去就從舊系統換成新系統。」現有機房的電力骨幹已經按照交流電邏輯鋪了幾十年,要全面切換成 800V 直流電架構(就是 takeway1 那張 NVIDIA 的機架示意圖),等於要替換所有配電設備、重訓工程師、重寫安全法規。

他提出的務實方案是把電源轉換設備搬出計算機架、放進旁邊一個獨立機架,用更細的線連回來,現有架構大致保留。不是最漂亮的解法,但它能做,也能解決當前AI 最吃緊的電力問題。

「贏的不一定是最好的技術,而是能夠規模化的那個。」這個邏輯不只適用於資料中心的硬體架構。我們每天在討論哪個 AI 模型最強,但回頭看,真正贏的從來不是 benchmark 第一名的那個,而是能讓大家習慣、馬上就可以使用的。

好啦,這週廢話太多了,讓我們進入本週的 AI 五件大事吧!


本周焦點事件

  1. 在場的各位都是 ____,Anthropic 推出最強模型 Fable 5
  2. WWDC 2026 Apple:Gemini Siri、Reframe
  3. 用 Mac 的絕對不能錯過的開源模型 Mac -1 ——行事曆、郵件、檔案,487 個工具全給它用
  4. text-to-lottie 短動畫 AI Skill:做 loading 動畫、icon 動態效果、簡單的品牌 splash 動畫
  5. 你每個月付的 API 費,Google 剛用一個免費開源模型把它折了一半

Read more

Google DeepMind Dream-RSI 遞歸自我改進框架官方主視覺海報

讓 AI 在歷史中「做夢」實現自我進化!Google DeepMind 發表 Dream-RSI:告別微調權重,探索算力成本暴降 162 倍,揭開遞歸自我改進(RSI)新範式

Google DeepMind 震撼發表 Dream-RSI(arXiv:2609.14858)!首創將歷史發現樹轉化為經驗回放模擬器,讓 AI 在低成本「夢境」中自我進化探索策略。Lasso 算法任務算力調用縮減 162 倍且超越 scikit-learn,刷新幾何極值與 GPU Kernel 性能,開啟安全高槓桿的 AGI 自展新範式。

QuiverAI 正式發表新一代向量生成模型 Arrow 2 與 Arrow 2 Telos

告別點陣像素與描摹地獄!a16z 押注 830 萬美元,QuiverAI 正式發表 Arrow 2 與 Arrow 2 Telos:首款原生代碼向量世界模型登場,幾何拓撲優化、微動畫與 MCP 代理革命深度解析

傳統生成式 AI 沉溺於像素點陣,但真實的軟體與設計世界由向量(SVG)統治!由 Mila 頂尖學者 Joan Rodríguez 創立、a16z 領投 830 萬美元的 QuiverAI,重磅發表新一代雙旗艦模型 Arrow 2 與 Arrow 2 Telos。徹底終結傳統「AI 生圖再描摹」的節點爆炸災難,以原生代碼生成精準、少控制點的乾淨幾何,並首創 SVG 微動畫引擎與原生 MCP 協議支援。本文深度拆解雙模型架構、拓撲優化技術、動畫原理解析、Cursor/VS Code Agent 整合實務與完整計費定價。

NVIDIA 震撼發表 CUDA Rust:雙軌並進打造記憶體安全 GPU 核心

NVIDIA 震撼發表 CUDA Rust!GPU 核心編程迎來記憶體安全革命:cuda-oxide 與 cutile-rs 雙軌並進、原生編譯 PTX 徹底告別 C++ 記憶體未定義行為深度解析

NVIDIA 官方宣布全力進軍原生 GPU Rust 編程!推出 SIMT 底層編譯器 cuda-oxide 與支援穩定版 Rust 1.89+ 的 Tile 程式設計庫 cutile-rs。透過 DisjointSlice 與張量分區所有權,徹底在編譯期消滅 GPU 資料競爭與未定義行為。本文完整拆解底層架構、向量加法代碼實測與產業影響。