Anthropic 发布 Claude Sonnet 5.5:更快、更低成本的日常 coding agent

Anthropic 于 9 月 28 日发布 Claude Sonnet 5.5,主打比 Sonnet 5 快 30% 以上、一般工作成本最多低 30%,并加入更完整的 coding、alignment 及高风险 cyber safeguards。

Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,将它定位为 Claude 5.5 家族中较快、较低成本的日常工作模型。它不是用来取代更适合复杂判断的 Opus 5.5,而是针对 well-scoped coding、修复 bug、制作文档、简报和电子表格等工作,提供更短的等待时间和更低的每项任务成本。

Anthropic 表示,Sonnet 5.5 的输出速度比 Sonnet 5 快 30% 以上,并以相同的 token 单价提供服务:每一百万 input tokens 2 美元、output tokens 10 美元、cache read 0.20 美元。供应商的重点是模型通常需要更少 tokens 才能完成同一任务,因此实际每项工作最多可节省 30%;实际成本仍取决于 effort level、工具调用和任务长度。

在 Anthropic 自己公布的评估中,Sonnet 5.5 在 Terminal-Bench 4.0 的分数是 70.6%,高于 Sonnet 5 的 10.3%;FrontierCode、CursorBench 和 AA-Briefcase 也有提升。这些数字是供应商及合作评估的结果,不能直接等同于所有代码库、团队流程或 production agent 的表现。Anthropic 自己也指出,Opus 5.5 在需要持续判断的复杂、开放式工作上仍然更强。

模型的另一个变化,是将 effort level 放到成本和速度的取舍中。Claude apps 的默认 effort 是 Medium,Claude Platform 的默认是 High;较低设置适合快速、规格清楚的工作,较高设置则会花更多时间检查结果。这使模型路由不再只是选择「哪个模型」,而是要一并决定任务风险、所需深度和可接受成本。

安全方面,Anthropic 表示 Sonnet 5.5 的 cyber 能力已大幅提升,因此发布时加入接近 Opus 5.5 的 cyber safeguards;较高风险的 cyber 任务可能 fallback 到 Sonnet 5。它也使用约 1,850 个情境进行 automated behavioral audit,并保留原有 biology safeguards。Anthropic 同时承认,没有任何一套评估可以捕捉所有失败,routine software work 和高风险安全工作需要分开治理。

Sonnet 5.5 已可在 Claude Platform、Amazon Web Services、Google Cloud 和 Microsoft Azure 使用,API model name 是 `claude-sonnet-5-5`。如果原本在 thinking off 状态使用 Sonnet,迁移时要改用新的 `between_tools` 设置;这是一个实际的整合细节,不能只把新模型名称替换到旧设置中。

对 coding agent 工作流而言,Sonnet 5.5 的意义更接近「把中等复杂度任务的单位成本降低」,而不是宣称所有工程工作都可以自动化。团队仍应使用自己的 repository、测试、权限和回滚流程重新评估,并把较高 effort 或 Opus 留给架构、跨文件判断和高影响变更。

MODULE.002 //

更多 Insights

分享网站、AI automation、数码营销、AI news 和 VMTS 公司新闻。