Gemini 3.6 Flash 是什麼?Google Antigravity 更新、效能與 API 價格整理

Google 推出 Gemini 3.6 Flash,並加入 Antigravity 2.0。新模型主打更少輸出 token、較低 API 輸出價格,以及更精簡的程式修改與工具呼叫流程。

Share
Gemini 3.6 Flash 在 Google Antigravity 上線的官方主視覺
Google 於 2026 年 7 月 21 日將 Gemini 3.6 Flash 加入 Antigravity 2.0。圖片來源:Google Antigravity。

Google 在 2026 年 7 月 21 日推出 Gemini 3.6 Flash,並同步把新模型加入 Google Antigravity。這次更新沒有只強調「回答更快」,而是把重點放在 AI Agent 真正會碰到的成本:輸出 token、推理步驟、工具呼叫次數,以及反覆修改程式碼的執行迴圈。

根據 Google 公布的資料,Gemini 3.6 Flash 在 Artificial Analysis Index 使用的輸出 token 比 3.5 Flash 少 17%,API 標準方案的輸出價格也從每百萬 token 9 美元降至 7.5 美元。對偶爾問答的使用者來說,差異可能不明顯;但對會長時間執行、多次呼叫工具的代理式工作流程,這才是最實際的升級。

我的判斷是,Gemini 3.6 Flash 值得 Antigravity 使用者優先測試,但不適合只看官方 benchmark 就直接取代現有正式環境。它最大的價值是降低完成一項任務所需的「總成本」,真正的考驗則是不同程式碼庫裡的成功率能否穩定重現。

Gemini 3.6 Flash 重點整理

項目 Gemini 3.6 Flash 更新重點
發布日期 2026 年 7 月 21 日
Antigravity 已加入 Google Antigravity 2.0
Token 效率 Artificial Analysis Index 的輸出 token 比 3.5 Flash 少 17%
API 標準價格 每百萬輸入 token 1.5 美元、輸出 token 7.5 美元
程式開發 官方稱可減少不必要修改與執行迴圈
適合工作 Coding、知識工作、多模態分析與多步驟 AI Agent 任務
評估重點 一次完成率、總 token、執行時間與人工修正次數

Gemini 3.6 Flash 更新了什麼?

Gemini 3.6 Flash 是 Google 為大量、日常工作設計的新一代 Flash 模型。Flash 並不是單純的輕量聊天模型,而是希望在品質、速度與成本之間取得平衡,讓開發者可以把它放進需要反覆推理與執行的 AI Agent。

Google 表示,新模型在三類任務上較 3.5 Flash 進步:程式開發、知識工作,以及多模態分析。多模態是指模型可以一起處理文字、圖片、圖表等不同形式的資料,而不是只能閱讀純文字。

官方列出的改善還包括:減少不必要的程式碼修改、降低執行迴圈次數,並用較少的推理步驟與工具呼叫完成多步驟工作。這些改進比「單次回覆快幾秒」更重要,因為 Agent 的延遲與費用會在每一輪操作中持續累積。

加入 Antigravity 後,實際差異在哪裡?

Google Antigravity 2.0 是以 AI Agent 為核心的桌面應用程式。使用者可以交付一個目標,讓 Agent 規劃步驟、操作工具、產出檔案,並透過子代理平行處理工作。它和傳統聊天機器人的差別,在於 Agent 不只是回答問題,而是會連續採取行動來完成任務。

Gemini 3.6 Flash 已可在 Antigravity 2.0 中使用。Google 展示的情境包括程式碼遷移、建立互動畫布,以及透過 Antigravity SDK 模擬多名使用者操作離線 Markdown 編輯器。官方宣稱,新模型在程式碼遷移上比 3.5 Flash 有更低延遲與更高品質。

Gemini 3.6 Flash 在 Google Antigravity 執行程式碼遷移的官方展示
Google 展示 Gemini 3.6 Flash 在 Antigravity 執行程式碼遷移;實際品質仍會受到專案與任務條件影響。圖片來源:Google Antigravity。

這裡真正值得注意的不是單一展示,而是模型與 Agent 執行框架一起調整。當一項任務需要讀取多個檔案、呼叫終端機、修改程式、執行測試再修正時,少一次錯誤修改或少一輪重跑,都可能比單次生成速度更有價值。

延伸閱讀:Google I/O 2026 完整總覽:Gemini 3.5、Antigravity 2.0、Android XR 眼鏡

輸出 token 少 17%,代表費用一定少 17% 嗎?

不一定。

Token 是模型處理文字時使用的計算單位。輸入 token 來自提示詞、檔案與上下文,輸出 token 則包含模型回覆,以及計費方案中納入的思考 token。Google 引用 Artificial Analysis Index 表示,Gemini 3.6 Flash 的輸出 token 使用量比 3.5 Flash 少 17%。

但這個數字來自特定測試,不代表每一種任務都會固定省下 17%。實際費用還會受到輸入長度、思考層級、工具呼叫、重試次數與任務成功率影響。如果模型輸出較短,卻需要人工修正或重新執行,整體成本未必比較低。

因此,團隊評估新模型時不應只記錄 token 數量,還要一起觀察一次完成率、總執行時間、工具呼叫次數與人工介入時間。這四項指標,才比較接近 AI Agent 的真實使用成本。

Gemini 3.6 Flash API 價格降多少?

Google Gemini API 價格頁顯示,Gemini 3.6 Flash 標準方案每百萬輸入 token 為 1.5 美元,每百萬輸出 token 為 7.5 美元。相較之下,Gemini 3.5 Flash 的輸入價格同樣是 1.5 美元,輸出價格則為 9 美元。

API 標準方案 Gemini 3.5 Flash Gemini 3.6 Flash 差異
每百萬輸入 token 1.5 美元 1.5 美元 不變
每百萬輸出 token 9 美元 7.5 美元 降低 16.7%
Gemini 3.5 Flash 與 Gemini 3.6 Flash 每百萬 token API 價格比較圖
標準方案輸入價格維持每百萬 token 1.5 美元,輸出價格由 9 美元降至 7.5 美元。資料來源:Google Gemini API Pricing,2026 年 7 月 21 日。

這代表 Google 並沒有全面調降所有費用,而是把成本改善集中在輸出端。對需要模型長時間思考、產生程式碼或報告的工作,影響會比短問答明顯。若再加上官方所稱的 token 使用量下降,每項 Agent 任務的總成本有機會進一步降低,但仍需用自己的工作負載測試。

官方 benchmark 有哪些進步?

Google 公布的結果顯示,Gemini 3.6 Flash 在 DeepSWE 的成績由 3.5 Flash 的 37% 提升至 49%,MLE Bench 由 49.7% 提升至 63.9%,OSWorld-Verified 則由 78.4% 提升至 83%。在知識工作評測 GDPval-AA v2,新模型的分數也由 1349 提升至 1421。

這些測試分別觀察軟體工程、機器學習研究、電腦操作與知識工作能力,可以看出 Google 想把 Flash 從「便宜、快速的回答模型」推向可執行複雜任務的工作模型。

Gemini 3.6 Flash 在 Antigravity 2.0 建立互動畫布體驗的官方展示
官方示範以 Gemini 3.6 Flash 搭配 Antigravity 2.0 與外部工具建立互動畫布。圖片來源:Google Antigravity。

不過,benchmark 是在固定資料集與評測條件下得到的結果,不等於每個團隊的專案都會有相同比例的提升。特別是舊程式碼庫、權限複雜的內部系統,以及需要精準操作瀏覽器的流程,仍應以實際成功率為準。

誰適合先切換 Gemini 3.6 Flash?

如果你已經使用 Antigravity 2.0 做程式碼遷移、文件整理、資料分析或多步驟自動化,Gemini 3.6 Flash 值得放進同一批任務做 A/B 測試。最適合優先測試的是執行頻率高、輸出內容長,或經常因工具呼叫與程式修改反覆重跑的工作。

若團隊目前只用 AI 做短問答、文案改寫,成本差距可能沒有那麼明顯。正式環境也不建議只因新模型上線就一次全面切換;較實際的做法,是先挑 20 至 50 個有明確驗收標準的任務,比較完成率、總 token、耗時與人工修正次數。

我的立場偏正面,因為「更少 token、較低輸出單價、較少執行迴圈」同時改善,方向上比只追求一個更高的 benchmark 分數更接近企業需求。如果實際測試沒有降低重試與人工修正,這項升級的價值就會大幅縮水。

Gemini 3.6 Flash 在哪裡可以使用?

Google 表示,Gemini 3.6 Flash 已於 2026 年 7 月 21 日開始提供,開發者可透過 Gemini API、Google AI Studio、Android Studio 與 Google Antigravity 使用;企業可從 Gemini Enterprise Agent Platform 與 Gemini Enterprise app 導入,一般使用者則可在 Gemini app 使用。

Antigravity 2.0 提供 macOS、Windows 與 Linux 版本。若模型選單尚未出現 Gemini 3.6 Flash,可能與帳號、地區或分批開放進度有關,不宜把社群個別截圖視為所有帳號都已同步取得。

延伸閱讀:Google AI Studio 重大升級:一句話生成正式上線的全端 App,整合 Firebase 與 Antigravity

常見問題

Gemini 3.6 Flash 比 3.5 Flash 便宜多少?

Gemini API 標準方案的輸入價格同為每百萬 token 1.5 美元;3.6 Flash 的輸出價格為 7.5 美元,比 3.5 Flash 的 9 美元低 16.7%。實際帳單仍會受到輸入長度、輸出量、工具與推理設定影響。

Gemini 3.6 Flash 真的能省 17% token 嗎?

Google 引用 Artificial Analysis Index 表示,新模型在該測試中使用的輸出 token 少 17%。這是 benchmark 結果,不是所有任務的保證值,團隊仍應用自己的提示詞與工作流程驗證。

Gemini 3.6 Flash 可以在 Antigravity 使用嗎?

可以。Google 已把 Gemini 3.6 Flash 加入 Antigravity 2.0,並以程式碼遷移、互動畫布與 SDK 工作流程作為示範。不過不同帳號的顯示時間可能有差異。

Gemini 3.6 Flash 適合取代 Pro 模型嗎?

不一定。Flash 的定位是兼顧速度、品質與成本,適合高頻與多步驟任務;需要最高推理品質的少量關鍵任務,仍應和 Pro 等級模型實測比較。選擇標準應是任務成功率與總成本,而不是只看模型名稱。

結語:這次升級的重點,是把 Agent 從「能做」推向「做得划算」

Gemini 3.6 Flash 對 Antigravity 的意義,不只是多一個模型選項。Google 正在把模型效率、工具呼叫與代理執行框架視為同一個產品問題,嘗試降低完成一項複雜任務所需的總成本。

對個人使用者,最直接的感受可能是等待時間與修改次數下降;對企業團隊,真正該追蹤的是每項成功任務的成本。如果 Gemini 3.6 Flash 能在真實專案維持較高完成率,同時減少 token、重跑與人工修正,它才會成為 Antigravity 的實用預設模型,而不只是版本號更新。

資料來源