
Anthropic 於 2026 年 9 月 28 日發布 Claude Sonnet 5.5,把它定位為 Claude 5.5 家族中較快、較低成本的日常工作模型。它不是用來取代較適合複雜判斷的 Opus 5.5,而是針對 well-scoped coding、修正 bug、製作文件、簡報和試算表等工作,提供更短的等待時間和較低的每項任務成本。
Anthropic 表示,Sonnet 5.5 的輸出速度比 Sonnet 5 快 30% 以上,並以同樣的 token 單價提供服務:每一百萬 input tokens 2 美元、output tokens 10 美元、cache read 0.20 美元。供應商的重點是模型通常需要更少 tokens 才能完成同一任務,因此實際每項工作最多可節省 30%;實際成本仍取決於 effort level、工具呼叫和任務長度。
在 Anthropic 自己公布的評估中,Sonnet 5.5 在 Terminal-Bench 4.0 的分數是 70.6%,高於 Sonnet 5 的 10.3%;FrontierCode、CursorBench 和 AA-Briefcase 也有提升。這些數字是供應商及合作評估的結果,不能直接等同於所有程式庫、團隊流程或 production agent 的表現。Anthropic 自己也指出,Opus 5.5 在需要持續判斷的複雜、開放式工作上仍然較強。
模型的另一個變化,是將 effort level 放到成本和速度的取捨中。Claude apps 的預設 effort 是 Medium,Claude Platform 的預設是 High;較低設定適合快速、規格清楚的工作,較高設定則會花更多時間檢查結果。這使模型路由不再只是選擇「哪個模型」,而是要一併決定任務風險、所需深度和可接受成本。
安全方面,Anthropic 表示 Sonnet 5.5 的 cyber 能力已大幅提升,因此發布時加入接近 Opus 5.5 的 cyber safeguards;較高風險的 cyber 任務可能 fallback 到 Sonnet 5。它亦使用約 1,850 個情境進行 automated behavioral audit,並保留原有 biology safeguards。Anthropic 同時承認,沒有任何一套評估可以捕捉所有失敗,routine software work 和高風險安全工作需要分開治理。
Sonnet 5.5 已可在 Claude Platform、Amazon Web Services、Google Cloud 和 Microsoft Azure 使用,API model name 是 `claude-sonnet-5-5`。如果原本在 thinking off 狀態使用 Sonnet,遷移時要改用新的 `between_tools` 設定;這是一個實際的整合細節,不能只把新模型名稱替換到舊設定中。
對 coding agent 工作流而言,Sonnet 5.5 的意義更接近「把中等複雜度任務的單位成本降低」,而不是宣稱所有工程工作都可以自動化。團隊仍應用自己的 repository、測試、權限和回滾流程重新評估,並把較高 effort 或 Opus 留給架構、跨檔案判斷和高影響變更。



