资讯

Claude Sonnet 5 正式发布:最强 Agentic Sonnet,性能逼近 Opus 4.8

Anthropic 于 2026 年 6 月 30 日正式发布 Claude Sonnet 5,定位为最强 Agentic Sonnet。新模型在编程、工具调用、推理等关键维度大幅超越 Sonnet 4.6,性能逼近 Opus 4.8,同时保持更低价格,即日起成为 Claude 免费版和 Pro 版的默认模型。

2026/7/13分钟 阅读ClaudeEagle

2026 年 6 月 30 日,Anthropic 正式推出 Claude Sonnet 5,这是 Sonnet 系列迄今最强的版本。新模型在 Agentic 能力、编程表现和知识推理方面全面升级,性能接近旗舰级 Opus 4.8,但价格更具竞争力。

核心定位

Claude Sonnet 5 能够自主制定计划、使用浏览器和终端等工具,并以几个月前只有大型昂贵模型才能达到的水平独立运行。

Sonnet 5 的目标很明确:缩小 Sonnet 与 Opus 之间的差距,让开发者以更低成本获得接近旗舰级的 Agentic 能力。

性能表现

基准测试对比

评测Sonnet 4.6Sonnet 5Opus 4.8
Agentic 编程(SWE-bench 类)58.1%63.2%69.2%
知识型工作略超 Opus 4.8
BrowseComp(网络搜索)大幅提升
OSWorld(计算机操作)大幅提升

实测亮点

根据早期合作伙伴反馈:

  • 完成复杂任务不中途停止:之前 Sonnet 模型跑到一半就放弃的任务,Sonnet 5 能跑完全程
  • 主动自检输出:不需要明确要求,模型会自动验证自己的结果
  • 多步骤工具协作:浏览器、终端、代码执行无缝串联

Zapier 高级工程师 Daniel Shepard 表示:

我们给 Claude Sonnet 5 分配了一个两步任务——更新 Salesforce 客户等级并发送上线公告——它从头到尾完成了整个流程。这在以前总会卡在中途。对于日常自动化来说,这是显而易见的选择。

定价

阶段输入 Token输出 Token
优惠期(至 2026 年 8 月 31 日)$2 / 百万$10 / 百万
正式价格(2026 年 9 月起)$3 / 百万$15 / 百万

优惠期内比 Sonnet 4.6 便宜约 33%,同时性能更强。比 OpenAI GPT-5.5 和 Google Gemini 3.1 Pro 更便宜。

安全性提升

Anthropic 安全评估显示,Sonnet 5 相比 Sonnet 4.6:

  • 整体误行为率 ↓ 下降
  • 幻觉率 ↓ 下降
  • 讨好行为(sycophancy)↓ 下降
  • 拒绝恶意请求能力 ↑ 提升
  • 抗 Prompt Injection 攻击 ↑ 明显加强

可用渠道

从 2026 年 6 月 30 日起:

  • Claude.ai:成为免费版和 Pro 版的默认模型
  • Claude Code:已支持,模型 ID claude-sonnet-5
  • Max / Team / Enterprise:全部可用
  • APIclaude-sonnet-5,优惠期至 8 月 31 日

总结

Claude Sonnet 5 代表了 Anthropic 中端模型策略的重要突破:用接近旗舰级的能力,提供 Sonnet 级别的定价。对于构建 Agent 工作流的开发者来说,这是目前性价比最高的选择。


原文来源:Introducing Claude Sonnet 5 — Anthropic 官方博客,2026-06-30

相关文章推荐

资讯Claude Code v2.1.197 更新:默认模型切换为 Sonnet 5,原生 1M Token 上下文Claude Code v2.1.197 将默认模型切换为 Claude Sonnet 5,带来原生 100 万 Token 上下文窗口。本文解析此次升级的核心变化、对现有工作流的影响,以及升级和回退方法。2026/7/3资讯2026 年 6 月大模型格局:Claude Sonnet 5、GPT-5.6 Sol 与 Gemini 3.5 Flash 三足鼎立2026 年 6 月,三大 AI 巨头密集发布中端新模型。对比 Claude Sonnet 5(6 月 30 日)、GPT-5.6 Sol(6 月 26 日)与 Gemini 3.5 Flash(5 月 19 日),分析 Agentic 时代的竞争新格局。2026/7/1资讯Claude Opus 4.6 深度解析:1M Token 上下文、SWE-bench 72.5%,AI 编程进入新阶段Claude Opus 4.6 深度解析:1M Token 上下文(Beta)、SWE-bench 72.5%,三大改进(谨慎计划/多步骤稳定/自我 review),以及何时选 Opus 而不是 Sonnet 的成本与性能权衡。2026/4/12资讯Claude 全线新模型默认加入隐形水印:不影响阅读、复制粘贴仍保留,你需要知道的几件事Anthropic 宣布自2026年8月2日起发布的新一代 Claude 模型默认为生成文本嵌入机器可识别隐形水印,响应欧盟AI法案合规要求,详解水印机制原理及"水印不等于纯AI原创"等关键细节。2026/8/13资讯Claude Opus 5 发布:以一半价格逼近 Fable 5 的前沿智能Anthropic 发布 Claude Opus 5,编程和知识工作评测登顶业界最佳,价格与 Opus 4.8 持平。详解基准测试数据、真实案例和定价可用性。2026/8/6资讯Anthropic 2026 年 7 月产品线全景:Claude Science、Reflect、Cowork 扩容与 Fable 5 复出一文汇总 Anthropic 2026年6月底至7月初的密集产品更新:面向科学家的全新工作台 Claude Science、AI 使用习惯反思工具 Claude Reflect、Cowork 正式登陆移动端和 Web、以及 Fable 5 出口管制风波的终章,并梳理这些更新背后串联起来的产品战略主线。2026/7/13