Sonnet 5 把过去需要更大模型完成的多步编码与工具任务下放到中档价位,永久价格为每百万输入 2 美元、输出 10 美元。

Claude Sonnet 5 把多步智能体能力带到了更适合日常使用的价格档位。它可以计划任务、调用浏览器和终端并持续执行,重点不是取代最强的 Opus,而是让更多常规编码和业务自动化不必动用旗舰模型。
Sonnet 5 的产品定位
Anthropic 于 2026 年 6 月 30 日发布 Claude Sonnet 5。官方称它是智能体能力最强的 Sonnet 模型,在推理、工具使用、编码和知识工作上明显超过 Sonnet 4.6,并在部分高努力等级任务上接近 Opus 4.8。

它在 Claude 免费版与 Pro 版成为默认模型,同时面向 Max、Team 和 Enterprise 提供。API 模型名为 claude-sonnet-5,永久价格为每百万输入 token 2 美元、输出 token 10 美元。
为什么“中档模型变强”更影响应用开发
旗舰模型决定能力上限,中档模型决定一个应用能否大规模运行。客服、文档处理、常规代码维护和内部流程每天可能产生大量调用,单次成本差异会在持续使用中被放大。只要 Sonnet 5 能以更少步骤完成任务,它就可能同时降低 token、延迟和失败重试。
官方案例集中在端到端执行:更新业务系统后发送通知、为真实拉取请求编写测试并修复、在老代码中追踪竞态条件。真正需要验证的不是它会不会生成代码,而是能否在已有约束中把工作推进到可审核状态。
努力等级成为新的成本旋钮
Sonnet 5 支持不同 effort 等级。更高努力可能改善复杂任务成功率,也会消耗更多时间和 token。开发者可以先用中等努力完成常规任务,只在遇到模糊需求、复杂调试或多工具协调时提高等级。
这比为每类任务维护完全不同的模型更灵活,但也容易造成账单不透明。团队应按任务记录努力等级、总调用次数、成功率和人工返工,而不是只看每百万 token 的标价。
Sonnet 还是 Opus,怎么选
Sonnet 产品页把它定位为高效率的默认模型。对于范围清楚、可测试的编码任务和日常业务流程,可以先用 Sonnet 5;涉及架构判断、跨领域研究、长时间持续执行或高风险交付时,再升级到 Opus 5。
最好的选择方式不是凭品牌印象,而是拿团队自己的 20 至 50 个真实任务做对照测试。模型在公开基准上的平均优势,未必等于它在你的代码规范、数据和工具权限下更可靠。
YouCanStudy.AI 的判断
Sonnet 5 的意义在于把“会行动的 AI”从高价演示拉向日常生产。随着中档模型接近上一代旗舰,应用的差异会更多来自上下文组织、工具质量和验收体系。模型已经足够强时,最该优化的往往不是继续换模型,而是让任务更清楚、工具更安全、结果更容易验证。