📅 2026年7月2日

Claude Sonnet 5 是什么?Anthropic 最强 agentic 模型全解析:价格、跑分与怎么用(2026)

Anthropic 于 2026 年 6 月 30 日发布 Claude Sonnet 5,主打「接近 Opus 的能力、更低的价格」。本文解析 Sonnet 5 的跑分、定价、effort 等级与新分词器,并给出现在怎么上手试用的具体步骤。

Claude Sonnet 5 是什么?Anthropic 最强 agentic 模型全解析:价格、跑分与怎么用(2026)

2026 年 6 月 30 日,Anthropic 正式发布 Claude Sonnet 5,并把它设为 claude.ai 上所有免费和 Pro 用户的默认模型。这次发布的核心卖点只有一句话:用接近旗舰 Opus 的能力,跑更便宜的 Agent。据 TechCrunch 报道,Sonnet 5 是 Anthropic 迄今最「agentic」的 Sonnet 模型。那么 Claude Sonnet 5 是什么、跑分和价格到底如何、现在怎么用?这篇一次讲清。

Claude Sonnet 5 是什么?一句话看懂这次发布

Claude Sonnet 5 是 Anthropic「Sonnet」系列的第五代,定位是中端主力模型——比旗舰 Opus 便宜得多,却能把很多过去只有大模型才能干的活儿接下来:制定计划、调用浏览器和终端等工具、长时间自主运行。简单说,它瞄准的是「要大量跑 AI Agent、又不想被 Opus 价格劝退」的开发者和团队。

Claude Sonnet 5 跑分:和 Opus 4.8、Sonnet 4.6 比差多少

根据 MarkTechPost 的对比,Sonnet 5 的关键基准如下:

基准 Claude Sonnet 5 Claude Opus 4.8
SWE-bench Pro(编程) 63.2% 69.2%
OSWorld-Verified(电脑操作) 81.2% 83.4%
Terminal-Bench 2.1(终端) 80.4% 74.6%
BrowseComp(智能搜索) 84.7%
GDPval-AA v2(知识工作,Elo) 1618 1615

可以看到:在编程和电脑操作上 Sonnet 5 略逊于 Opus 4.8,但在终端任务上反超 Opus,在知识工作 Elo 上几乎打平。对绝大多数实际场景,这个差距远小于两者的价格差距。

Claude Sonnet 5 价格:为什么说它是「跑 Agent 更便宜的选择」

价格是这次发布的重头戏。Sonnet 5 的引入期(introductory)定价为每百万输入 token 2 美元、输出 10 美元,有效期到 2026 年 8 月 31 日;9 月起调整为 3 美元 / 15 美元。作为对比,Opus 4.8 是 5 美元 / 25 美元。也就是说,在引入期用 Sonnet 5,输入成本只有 Opus 的四成左右。对需要海量调用、长时间跑自动化的 Agent 场景,这个价差会被成倍放大。

effort 等级与新分词器:两个必须知道的细节

第一,Sonnet 5 引入了 effort(努力)等级:low、medium、high、xhigh。等级越高,模型在推理上花的 token 越多,质量更高但更贵——你可以按任务难度自己权衡。第二个容易踩坑的点:Sonnet 5 换了新的分词器,同样一段文字可能被切成多达 1.35 倍的 token。这意味着不能只看单价,实际账单要把 token 膨胀算进去,迁移前务必用真实样本测一遍。

Claude Sonnet 5 怎么用?现在上手的 3 步实操

第一步,最快体验:直接打开 claude.ai,免费或 Pro 用户现在的默认模型就是 Sonnet 5,无需切换即可对话试用。

第二步,开发者接入:在 API 里把模型名指定为 Sonnet 5 对应的模型字符串,先用一小段真实业务数据跑一遍,重点观察输出质量和 token 消耗。

第三步,用在 Agent / 编程:在 Claude Code 或你的 Agent 框架里把默认模型切到 Sonnet 5,先用 medium effort 跑常规任务,遇到复杂推理再临时提到 high 或 xhigh。这样能在成本和效果间取得平衡。

Marco 观点:Sonnet 5 值不值得跟进?谁最该换

我的判断是:大批量、自动化、成本敏感的场景,Sonnet 5 几乎是没有悬念的默认选择;而对极限编程质量、复杂 debug 有硬要求的,仍建议保留 Opus 4.8。最该立刻换的是两类人:一是天天跑 Agent、账单被 token 拖累的团队;二是做产品原型、需要频繁调用但预算有限的中小团队和个人开发者。要提醒的坑有两个——新分词器会让「便宜」打折扣,一定要按真实用量重新算账;effort 等级用错也会悄悄烧钱,别默认拉满。整体看,这是 Anthropic 把「能力下放、价格下探」推进了一大步,对中文开发者尤其友好,因为它降低了长期跑自动化的门槛。

常见问题 FAQ

问:Claude Sonnet 5 免费能用吗? 答:可以。发布当天起,claude.ai 上的免费和 Pro 用户默认就是 Sonnet 5。

问:Sonnet 5 比 Opus 4.8 差很多吗? 答:在编程、电脑操作上略低几个百分点,但在终端任务上更强、知识工作几乎打平,性价比明显更高。

问:为什么大家都在提它的新分词器? 答:因为同样文字可能多出最多 1.35 倍 token,直接影响实际花费,迁移时必须重新测算成本。

问:什么时候该用 Opus 而不是 Sonnet 5? 答:当你对极限编程质量、复杂长链推理有硬要求、且预算充足时,Opus 4.8 仍更稳。

延伸阅读

写在最后

Claude Sonnet 5 的发布,把「接近旗舰的能力 + 更低的价格」变成了现实,对要大规模跑 Agent 的人来说是实打实的利好。但记得两件事:按真实用量重新算 token 账、按任务难度选对 effort 等级。想第一时间跟上 AI 大模型的每一次重要更新与上手实测,欢迎关注 Marco聊科技,订阅我们的免费 AI 资源,把最新的 AI 工具用起来。

Marco聊科技 — AI 工具 · 教程 · 自动化

Marco 分享最新的 AI 工具评测、Claude / ChatGPT / Gemini 深度教程,以及 AI 自动化与效率提升技巧,帮助你在 AI 时代保持领先。以下是最新发布的文章:

查看全部文章 →