Claude Sonnet 5.5 發布:快 30%、每次任務成本最高降 30%,值得換嗎?
Claude Sonnet 5.5 的 API 單價沒有降,卻可能用更少 token 與步驟完成工作。本文比較速度、成本、評測、適用情境與升級相容性。
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5。官方把它定位成 Claude 5.5 家族裡兼顧速度與能力的模型,主打日常 coding、修 bug、文件、簡報、試算表與多步驟工具工作。
這次最容易誤解的數字是「成本最高降低 30%」。Claude Sonnet 5.5 的 API(讓應用程式呼叫 Claude 的介面)單價沒有比 Sonnet 5 便宜,官方的意思是新模型通常用更少的 token 與步驟完成同一件事,所以每次任務的總成本可能下降。
我的判斷是:如果工作範圍清楚、會大量重複執行,Sonnet 5.5 很值得優先測試。如果任務需要長時間規劃、模糊需求取捨或高風險判斷,Opus 5.5 仍比較適合。本文會拆解價格、速度、官方評測與升級時要注意的相容性變更。
Claude 官方 13 秒發布短片,以拼貼畫面介紹 Sonnet 5.5。 影片來源:Claude 官方 X。
Claude Sonnet 5.5 是什麼?
Claude Sonnet 5.5 是 Anthropic 在 Claude 5.5 家族推出的第二款模型,前一款是 Claude Opus 5.5。兩者都能處理文字、圖片與工具呼叫,但用途不同。
Sonnet 5.5 主打速度、成本與能力之間的平衡。你可以把它想成日常工作主力:程式需求已經寫清楚、文件有固定格式、資料整理有明確欄位,或 AI Agent 需要連續呼叫多個工具。Opus 5.5 則更偏向架構設計、長時間研究、模糊需求與需要持續判斷的工作。
官方文件列出的 Claude Sonnet 5.5 規格包括 100 萬 token 的上下文視窗,以及最多 12.8 萬 token 的輸出。上下文視窗就是模型一次能讀進去的文字、圖片與對話範圍。token 則是模型計算文字長度與費用的基本單位。
這些上限讓 Sonnet 5.5 能處理大型程式庫或長文件,但上限大不代表每次都應塞滿資料。對高頻工作來說,真正影響成本的仍是每次用了多少輸入、輸出與工具步驟。
價格沒變,為什麼每次任務能便宜最多 30%?
Sonnet 5.5 與 Sonnet 5 的 API 標價相同。2026 年 9 月 29 日的官方價格如下:
| 計價項目 | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 |
|---|---|---|---|
| 輸入,每 100 萬 token | US$2 | US$2 | US$4 |
| 輸出,每 100 萬 token | US$10 | US$10 | US$20 |
| 快取讀取,每 100 萬 token | US$0.20 | US$0.20 | US$0.20 |
| 快取寫入,每 100 萬 token | US$2.50 | US$2.50 | US$5 |
「最多省 30%」來自完成任務所需的總資源下降,而非 token 單價打七折。Anthropic 表示,Sonnet 5.5 在官方測試中會用更少 token 完成相同工作。部分早期測試者也回報工具呼叫與命令列操作次數下降。
對開發團隊而言,這個差別比單次聊天的感受更重要。假設一個 coding agent 每天執行數千次修正、檢查與資料整理,少走幾個步驟會同時縮短等待時間、降低 token 費用,也減少工具呼叫失敗的機會。
但「最高 30%」是官方測試結果,不是每個 prompt 的固定折扣。若既有工作本來就很短,或主要成本來自外部工具、網路搜尋與人工審核,實際節省幅度可能較小。
速度快 30% 以上,對使用者有什麼差別?
Anthropic 表示,Sonnet 5.5 的文字輸出速度比 Sonnet 5 快 30% 以上,是目前最快的 Sonnet 模型。速度提升最直接的影響,是等待模型產生內容的時間縮短。
對一般使用者來說,撰寫文件、修改簡報與整理試算表會更快看到結果。對 coding agent 而言,模型通常要在「讀程式碼、呼叫工具、檢查結果、再次修改」之間往返。每一輪都快一些,整個任務的體感差距就會被放大。
這也是為什麼我更重視「快、少步驟、少 token」的組合,而不是只看單一 benchmark 分數。企業把 AI 放進客服、內部搜尋或程式開發流程時,回應品質只是門檻,延遲與每次任務成本才決定能不能大規模使用。

官方評測真的追上 Opus 5.5 了嗎?
Anthropic 公布的評測裡,Sonnet 5.5 在多項 coding 與知識工作測試明顯超過 Sonnet 5,部分結果接近 Opus 5.5。
| 官方公布評測 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1 | 1844 Elo | 1449 Elo | 1846 Elo |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% |
Terminal-Bench 測試模型能否在命令列環境完成多步驟工作,CursorBench 則使用真實 coding session 衍生的模糊、多檔案任務。GDPval-AA 用不同職業的真實工作衡量知識任務,OSWorld 測試操作電腦介面的能力。
這些數字支持「Sonnet 5.5 是明顯升級」,卻不足以證明它在所有工作都勝過 Opus 5.5。不同模型可能使用不同 effort,也就是讓模型投入多少推理資源的設定。評測工具、時間限制與安全回退也會改變結果。
Anthropic 自己也提醒,Opus 5.5 在複雜、開放式且需要長時間判斷的工作上仍明顯更強。我的解讀是,Sonnet 5.5 已把很多原本要交給高階模型的日常任務往下承接,但不該只因一張表就把高風險任務全部換掉。
Sonnet 5.5、Sonnet 5、Opus 5.5 怎麼選?
選模型時,可以先問兩件事:任務是否有清楚完成標準,以及錯誤的代價有多高。
| 使用情境 | 建議模型 | 原因 |
|---|---|---|
| 日常問答、文件、簡報、試算表 | Sonnet 5.5 | 速度快,格式與完成標準通常清楚 |
| 修 bug、程式修改、批次 code review | Sonnet 5.5 | coding 能力提升,單次任務成本較容易控制 |
| 大量客服、分類與資料抽取 | Sonnet 5.5 | 適合高頻、範圍固定的流程 |
| 大型系統架構、長時間研究 | Opus 5.5 | 需要持續判斷與跨步驟取捨 |
| 高風險決策前的最後分析 | Opus 5.5 加人工覆核 | 模型能力不能取代責任與查證 |
| 已穩定運作的 Sonnet 5 系統 | 先做回歸測試 | 新版有 API 相容性變更,不能只換 model ID |
如果目前還在用 Sonnet 5,新專案可直接把 Sonnet 5.5 納入測試。既有系統則應用自己的 prompt、工具與資料集做並排比較。真正該看的指標包括成功率、總 token、工具呼叫次數、總延遲與需要人工修正的比例。
開發者升級前要先檢查哪些相容性變更?
Claude Sonnet 5.5 的 API model ID 是 claude-sonnet-5-5。不過,既有程式不能只把舊名稱換掉就直接上線,官方文件列出幾項會讓請求失敗或改變回應格式的變更。
第一,若程式用 thinking: disabled 關閉前置思考,要改成 thinking: between_tools。thinking 是模型在回答與工具呼叫前後配置推理資源的機制,設定方式改變後,舊請求可能直接收到 400 錯誤。
第二,Sonnet 5.5 不支援強制指定一定要呼叫某個工具。原本使用 tool_choice: any 或指定工具名稱的程式,要改用自動選擇,再搭配嚴格輸入格式或在 prompt 裡說清楚何時應使用工具。
第三,thinking blocks 會與模型和對話綁定。若應用會修改較早的對話、跨帳號搬移 session,或在中途更換模型,就要依官方 migration guide 處理,否則模型可能丟棄舊推理區塊或回傳錯誤。
使用 computer use 的團隊也要檢查工具版本。Claude API 與 Google Cloud 上的 Sonnet 5.5 不接受較舊的 computer_20251124,需要改用 computer_toolset_20260801。
安全措施會影響一般 coding 嗎?
Sonnet 5.5 是第一款在發布時加入高階資安防護與回退機制的 Sonnet 模型。遇到高風險資安請求時,系統可能拒絕、回退到 Sonnet 5,或要求使用通過驗證的方案。
Anthropic 表示,一般軟體開發、找 bug 與修正程式不受影響。生物相關防護則延續 Sonnet 5 的做法,主要針對少數高風險請求。官方也加入防止大規模蒸餾攻擊的措施,降低他人透過大量假帳號抽取模型能力的風險。
安全評測依然有侷限。Anthropic 的自動行為稽核涵蓋約 1,850 個情境,但官方明確承認任何評測都無法抓到所有失敗。因此,涉及資安、醫療、金融或不可逆操作時,模型輸出仍需要權限限制、紀錄與人工覆核。
Claude Sonnet 5.5 值得換嗎?
如果你的工作是 coding、文件、簡報、客服或多步驟工具流程,我會把 Sonnet 5.5 列為新的優先測試對象。它沒有降低 API token 單價,卻透過更少 token、較少步驟與更快輸出,改善大規模使用最在意的總成本與等待時間。
我不會因為官方 benchmark 接近 Opus 5.5,就把所有複雜任務都改用 Sonnet 5.5。更合理的做法是讓 Opus 5.5 負責架構、研究與高風險判斷,再讓 Sonnet 5.5 執行範圍清楚、可以驗收的工作。
這個判斷是否成立,最後仍要看自己的資料。升級測試至少記錄成功率、總 token、工具呼叫次數、延遲與人工修正比例。如果品質沒有維持,官方宣稱的成本下降就沒有實際意義。
FAQ
Claude Sonnet 5.5 什麼時候推出?
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5。它已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 Claude Platform on AWS 提供。
Claude Sonnet 5.5 API 價格是多少?
輸入每 100 萬 token 為 US$2,輸出為 US$10,快取讀取為 US$0.20,5 分鐘快取寫入為 US$2.50。這些單價與 Sonnet 5 相同。
官方說成本降低 30%,是 API 降價嗎?
不是。官方說法是 Sonnet 5.5 通常用更少 token 與步驟完成相同工作,所以每次任務的總成本在官方測試中最高下降 30%。實際節省幅度會依 prompt、工具與任務而不同。
Claude Sonnet 5.5 比 Opus 5.5 強嗎?
部分 coding 與知識工作評測很接近,但 Anthropic 仍把 Opus 5.5 定位在更複雜、開放式且需要持續判斷的工作。日常高頻任務可先測 Sonnet 5.5,架構與高風險工作仍優先考慮 Opus 5.5。
從 Sonnet 5 升級只要換 model ID 嗎?
不只如此。除了改成 claude-sonnet-5-5,還要檢查 thinking 設定、強制工具呼叫、thinking blocks 的保存方式,以及 computer use 工具版本。上線前應跑完既有回歸測試。