Claude Sonnet 5 发布:Agent 能力接近 Opus,API 价格更亲民
Claude Sonnet 5 发布,最值得关注的是什么
Anthropic 今天推出 Claude Sonnet 5,并把它作为免费版和 Pro 版默认模型。对开发者来说,这次更新最有价值的地方,不只是“新模型上线”,而是 Sonnet 系列终于把和高阶模型之间的能力差距拉回来了。
简单理解,Sonnet 5 的定位很清晰:AI Agent 能力更强,价格却仍然比顶级模型更友好。Anthropic 直接把它放到主力档位,说明这个版本已经具备了大量实际应用场景的落地价值。
Agent 能力提升,复杂任务更容易跑完
过去一段时间,AI Agent 的进步主要集中在更贵的 Opus 系列,Sonnet 和它们的差距越来越明显。Sonnet 5 的发布,核心就是把这个差距缩小。
从公开基准来看:
- Agent 编程基准:Sonnet 5 得分 63.2%,高于 Sonnet 4.6 的 58.1%。
- Opus 4.8 的同项得分为 69.2%,Sonnet 5 已经接近高配模型。
- 在知识工作基准上,Sonnet 5 甚至略微超过了 Opus 4.8。
这意味着,像多步骤执行、工具调用、任务拆解、结果复核这类工作,Sonnet 5 会更稳定。对于需要模型持续推进任务的场景,这是很关键的提升。
实际体验更像“能把活干完”
早期测试者的反馈也比较一致。过去 Sonnet 在执行复杂任务时,常常会中途停住,或者做到一半就需要人工接手。Sonnet 5 则更像一个能完整收尾的执行型模型。
例如有工程师测试让模型连续完成“更新 Salesforce 账户等级,再给企业客户发公告邮件”这样的流程,Sonnet 5 可以一口气做完,不容易卡在半路。对企业自动化来说,这种差别非常实用,因为真正麻烦的往往不是“会不会做”,而是“能不能做完”。
价格更亲民,但仍要注意 token 成本
Sonnet 5 的 API 定价也很有看点。Anthropic 提供了两阶段价格:
- 8 月 31 日前推广价:输入 2 美元/百万 Token,输出 10 美元/百万 Token。
- 之后恢复到:输入 3 美元/百万 Token,输出 15 美元/百万 Token。
从对比来看,这个价格低于 OpenAI 的 GPT-5.5 和 Google 的 Gemini 3.1 Pro,但高于更轻量的 Gemini 3.5 Flash。也就是说,它不是最便宜的,但在能力和成本之间,依然属于比较均衡的一档。
需要注意的是,Sonnet 5 换了新的分词器,同样一段文本可能消耗 1.0 到 1.35 倍的 Token。Anthropic 表示推广期价格已经对冲了这部分变化,但推广期结束后,真实使用成本可能会比表面标价更高一些。对于高频调用的团队,这一点要提前算清楚。
安全性也有改进,适合更开放的 Agent 场景
除了能力提升,Sonnet 5 在安全方面也做了加强。官方提到,它的幻觉率和迎合倾向低于前代,面对提示注入和恶意请求时的抵御能力更强。
这对 Agent 场景很重要,因为一旦模型开始调用工具、读取外部信息、执行自动化流程,安全问题就不只是“答错题”这么简单,还可能影响业务操作。Sonnet 5 默认开启实时安全防护,也让它更适合放到真实工作流中使用。
哪些人最适合用 Sonnet 5
如果从使用场景来看,Sonnet 5 比较适合下面几类用户:
- 开发者:需要模型写代码、改代码、调工具、跑多步任务。
- 运营和销售团队:适合做自动化流程、邮件处理、客户信息整理。
- 知识工作者:适合长文整理、资料归纳、信息对比和复核。
- 希望控制成本的企业:想要接近高阶模型的体验,但预算不能太高。
如果任务偏简单,比如基础问答、轻量文本处理,低成本模型也能满足需求。但一旦开始做连续执行、复杂决策和工具联动,Sonnet 5 的优势会更明显。
上线范围和实际意义
从今天起,Claude 所有套餐、Claude Code 和 API 都可以使用 Sonnet 5,模型代号是 claude-sonnet-5。对用户来说,这种“直接默认切换”的动作,说明 Anthropic 对它的稳定性和实用性有足够信心。
整体来看,Claude Sonnet 5 的意义不是单纯升级参数,而是把“高能力 Agent”变成了更容易普及的主力模型。它在能力、价格和安全之间找到了一个更实用的平衡点,也让 Sonnet 系列重新回到竞争核心。
如果之前觉得高阶模型太贵、轻量模型又不够稳定,那么 Sonnet 5 可能就是现在更值得试的一档。
创建: 2026-07-01
关联文章推荐
- Claude Code 被指在系统提示词里“打水印”:中国代理用户到底发生了什么
- Anthropic Fable 5 与 Mythos 5 解禁:美国出口管制松动背后的AI新变量
- Claude Code木马门真相:Anthropic承认回滚,隐形代码细节曝光
- Claude Sonnet 5 发布:Agent 能力接近 Opus,API 价格更亲民
- Claude Fable 5重新上线:恢复全球访问,新增安全分类器与降级机制
- 小红书RED Skill是什么?8个高关注AI技能盘点
- Bloome多智能体编程是什么?一文看懂协作式AI编码
- Omnigent:统一管理AI代理的开源编排框架
- 阿里内部全面禁用Claude Code:后门风险引关注,Qoder成替代方案
- Codex Plugin for Claude Code 使用指南:安装、命令与工作流一文看懂
- Claude Code + Codex 混合工作流爆火:Fable 5 负责大脑,Codex 负责执行
- Claude Fable 5 免费试用延期至7月12日,使用限制一次看懂
- Step Edge端侧模型全家桶发布:手机AI应用迎来新升级
- FDE是什么?AI Agent时代最稀缺的前线部署工程师机会
- Kimi K3发布:全球首个开源3万亿级模型,长程Agent能力惊艳
- 飞猪裁员引争议:CTO线从1244人缩至916人,OTA行业压力有多大
登录后才能发布评论哦
立即登录/注册