Claude Sonnet 5 是什么?Anthropic 最强 agentic 模型全解析:价格、跑分与怎么用(2026)
Anthropic 于 2026 年 6 月 30 日发布 Claude Sonnet 5,主打「接近 Opus 的能力、更低的价格」。本文解析 Sonnet 5 的跑分、定价、effort 等级与新分词器,并给出现在怎么上手试用的具体步骤。
2026 年 6 月 30 日,Anthropic 正式发布 Claude Sonnet 5,并把它设为 claude.ai 上所有免费和 Pro 用户的默认模型。这次发布的核心卖点只有一句话:用接近旗舰 Opus 的能力,跑更便宜的 Agent。据 TechCrunch 报道,Sonnet 5 是 Anthropic 迄今最「agentic」的 Sonnet 模型。那么 Claude Sonnet 5 是什么、跑分和价格到底如何、现在怎么用?这篇一次讲清。
Claude Sonnet 5 是什么?一句话看懂这次发布
Claude Sonnet 5 是 Anthropic「Sonnet」系列的第五代,定位是中端主力模型——比旗舰 Opus 便宜得多,却能把很多过去只有大模型才能干的活儿接下来:制定计划、调用浏览器和终端等工具、长时间自主运行。简单说,它瞄准的是「要大量跑 AI Agent、又不想被 Opus 价格劝退」的开发者和团队。
Claude Sonnet 5 跑分:和 Opus 4.8、Sonnet 4.6 比差多少
根据 MarkTechPost 的对比,Sonnet 5 的关键基准如下:
| 基准 | Claude Sonnet 5 | Claude Opus 4.8 |
|---|---|---|
| SWE-bench Pro(编程) | 63.2% | 69.2% |
| OSWorld-Verified(电脑操作) | 81.2% | 83.4% |
| Terminal-Bench 2.1(终端) | 80.4% | 74.6% |
| BrowseComp(智能搜索) | 84.7% | — |
| GDPval-AA v2(知识工作,Elo) | 1618 | 1615 |
可以看到:在编程和电脑操作上 Sonnet 5 略逊于 Opus 4.8,但在终端任务上反超 Opus,在知识工作 Elo 上几乎打平。对绝大多数实际场景,这个差距远小于两者的价格差距。
Claude Sonnet 5 价格:为什么说它是「跑 Agent 更便宜的选择」
价格是这次发布的重头戏。Sonnet 5 的引入期(introductory)定价为每百万输入 token 2 美元、输出 10 美元,有效期到 2026 年 8 月 31 日;9 月起调整为 3 美元 / 15 美元。作为对比,Opus 4.8 是 5 美元 / 25 美元。也就是说,在引入期用 Sonnet 5,输入成本只有 Opus 的四成左右。对需要海量调用、长时间跑自动化的 Agent 场景,这个价差会被成倍放大。
effort 等级与新分词器:两个必须知道的细节
第一,Sonnet 5 引入了 effort(努力)等级:low、medium、high、xhigh。等级越高,模型在推理上花的 token 越多,质量更高但更贵——你可以按任务难度自己权衡。第二个容易踩坑的点:Sonnet 5 换了新的分词器,同样一段文字可能被切成多达 1.35 倍的 token。这意味着不能只看单价,实际账单要把 token 膨胀算进去,迁移前务必用真实样本测一遍。
Claude Sonnet 5 怎么用?现在上手的 3 步实操
第一步,最快体验:直接打开 claude.ai,免费或 Pro 用户现在的默认模型就是 Sonnet 5,无需切换即可对话试用。
第二步,开发者接入:在 API 里把模型名指定为 Sonnet 5 对应的模型字符串,先用一小段真实业务数据跑一遍,重点观察输出质量和 token 消耗。
第三步,用在 Agent / 编程:在 Claude Code 或你的 Agent 框架里把默认模型切到 Sonnet 5,先用 medium effort 跑常规任务,遇到复杂推理再临时提到 high 或 xhigh。这样能在成本和效果间取得平衡。
Marco 观点:Sonnet 5 值不值得跟进?谁最该换
我的判断是:大批量、自动化、成本敏感的场景,Sonnet 5 几乎是没有悬念的默认选择;而对极限编程质量、复杂 debug 有硬要求的,仍建议保留 Opus 4.8。最该立刻换的是两类人:一是天天跑 Agent、账单被 token 拖累的团队;二是做产品原型、需要频繁调用但预算有限的中小团队和个人开发者。要提醒的坑有两个——新分词器会让「便宜」打折扣,一定要按真实用量重新算账;effort 等级用错也会悄悄烧钱,别默认拉满。整体看,这是 Anthropic 把「能力下放、价格下探」推进了一大步,对中文开发者尤其友好,因为它降低了长期跑自动化的门槛。
常见问题 FAQ
问:Claude Sonnet 5 免费能用吗? 答:可以。发布当天起,claude.ai 上的免费和 Pro 用户默认就是 Sonnet 5。
问:Sonnet 5 比 Opus 4.8 差很多吗? 答:在编程、电脑操作上略低几个百分点,但在终端任务上更强、知识工作几乎打平,性价比明显更高。
问:为什么大家都在提它的新分词器? 答:因为同样文字可能多出最多 1.35 倍 token,直接影响实际花费,迁移时必须重新测算成本。
问:什么时候该用 Opus 而不是 Sonnet 5? 答:当你对极限编程质量、复杂长链推理有硬要求、且预算充足时,Opus 4.8 仍更稳。
延伸阅读
- AI 怎么用更省钱?2026 从「堆 token」到效率优先的省钱指南
- AI 提示词怎么写?2026 高质量 Prompt 框架 + 可复现模板(附完整示例)
- 智谱 GLM-5.2 是什么?国产开源大模型编程超 GPT-5.5 全解析(2026)
写在最后
Claude Sonnet 5 的发布,把「接近旗舰的能力 + 更低的价格」变成了现实,对要大规模跑 Agent 的人来说是实打实的利好。但记得两件事:按真实用量重新算 token 账、按任务难度选对 effort 等级。想第一时间跟上 AI 大模型的每一次重要更新与上手实测,欢迎关注 Marco聊科技,订阅我们的免费 AI 资源,把最新的 AI 工具用起来。