Anthropic发布Claude Sonnet 5,以更低成本运行AI代理

TechCrunch AI 模型

摘要

Anthropic发布了Claude Sonnet 5,这是一款更强大、更具成本效益的智能代理模型,与OpenAI的GPT-5.6 Sol和Google的Gemini 3.5 Flash竞争,提供更强的自主性和更低的价格。

Anthropic的Claude Sonnet 5带来了更强的智能代理能力、更低的价格和更高的安全性,将这款模型定位为Opus、GPT-5.5和Gemini Pro的更便宜替代品。
查看原文
查看缓存全文

缓存时间: 2026/06/30 18:39

# Anthropic 推出 Claude Sonnet 5:运行代理的更便宜方案 | TechCrunch 来源:https://techcrunch.com/2026/06/30/anthropic-launches-claude-sonnet-5-as-a-cheaper-way-to-run-agents/ 随着提供代理能力成为基础模型公司的基本门槛,Anthropic 发布了 Claude Sonnet 5,这是该实验室中型模型更强大、更具自主代理能力的版本。 “它能够制定计划、使用浏览器和终端等工具,并以自主方式运行,而就在几个月前,这些任务还需要更大、更昂贵的模型才能完成。”Anthropic 在[一篇博文](https://www.anthropic.com/news/claude-sonnet-5)中表示。 这一表述与 OpenAI 和 Google 对其近期发布的描述如出一辙。OpenAI 的 [GPT-5.6 Sol](https://techcrunch.com/2026/06/26/openai-limits-gpt-5-6-rollout-after-government-request-says-restrictions-shouldnt-be-the-norm/) 于上周以预览形式推出,这也是该公司最具代理能力的模型,允许用户将任务拆分成多个子代理以完成更长的自主任务。Google 的 [Gemini 3.5 Flash](https://techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbots/) 于五月发布,被定位为从对话式聊天机器人向代理型工具的转变,能够自主规划、构建和迭代实际工作,几乎无需人工介入。 Sonnet 5 的发布确认了代理能力已成为每个价格层级的新基线标准。如今,区别将不再是谁能最好地完成代理工作,而是谁能以更低成本完成,以及谁能在无需人工监督的情况下更可靠地运行。 Sonnet 5 承诺在性能上接近 [Opus 4.8](https://techcrunch.com/2026/05/28/anthropic-releases-opus-4-8-with-new-dynamic-workflow-tool/),但成本低得多。自周二起,Claude Sonnet 5 将成为免费和 Pro 计划的默认模型,并面向所有订阅用户开放。 发布初期,Sonnet 5 的定价为每百万输入 token 2 美元、每百万输出 token 10 美元,优惠持续至8月31日,之后价格将上调至每百万输入 token 3 美元、每百万输出 token 10 美元。这使得 Sonnet 5 比 Opus 4.8、OpenAI 的 GPT-5.5 以及 Google 的 Gemini 3.1 Pro 都更便宜(但仍比 Gemini 3.5 Flash 贵)。 Anthropic 表示,与今年2月发布的[前代模型 Sonnet 4.6](https://techcrunch.com/2026/02/17/anthropic-releases-sonnet-4-6/)相比,新模型在推理、工具使用、软件编码和知识工作等代理性能方面亦有显著提升。 例如,在一项基准测试中,Sonnet 5 在代理编码任务上得分为63.2%,而 Opus 4.8 为69.2%,Sonnet 4.6 为58.1%。在知识工作基准测试中,Sonnet 5 实际上略优于 Opus 4.8 —— 后者以擅长解决极难问题(如微妙判断和深度研究)而著称。 “Opus 4.8 在这些任务上仍然是追求更高准确率的首选模型,但 Sonnet 5 为开发者提供了价格更低的选项,且质量远超此前任何可用方案。”Anthropic 表示,“通过 Sonnet 5 和 Opus 4.8,用户可以根据任务需求调整努力程度,找到成本与性能的最佳平衡点。” 根据博文中引用的测试者反馈,Sonnet 5 还擅长完成复杂任务,而之前的模型版本往往会在中途停止。Sonnet 5 还能“在未被明确要求的情况下自行检查输出”。 “我们交给 Claude Sonnet 5 一个两步任务 —— 更新 Salesforce 账户等级,并向企业联系人发送发布公告 —— 它从头到尾完成了整个过程。”Zapier 高级工程师 Daniel Shepard 在一份声明中表示,“这在以前常常中途卡住。对于日常自动化来说,这是再自然不过的选择。” 在安全性方面,Sonnet 5 在“不良行为”(如协助误用和欺骗)的发生率上也低于前代,使其在代理场景中更安全。它能更好地拒绝恶意请求,规避提示注入攻击中的劫持尝试。其幻觉和谄媚行为的发生率也低于 Sonnet 4.6。 不过,在不当行为防范方面,它仍未达到 Opus 4.8 和 Claude Mythos Preview 的水平。“评估还显示,它执行危险网络安全任务的能力远低于我们目前的 Opus 模型。”博文中写道。 Lovable 联合创始人 Fabian Hedin 在一份声明中表示,Claude Sonnet 5“能够干净且一致地拒绝不安全请求。” “在 Lovable,我们正在将强大的工具交到数百万创造者手中。”Hedin 说,“一个知道何时说不的模型,与一个知道如何构建的模型同等重要。” *通过我们文章中的链接购买商品,我们可能会获得小额佣金([https://techcrunch.com/techcrunch-affiliate-monetization-standards/](https://techcrunch.com/techcrunch-affiliate-monetization-standards/))。这不会影响我们的编辑独立性。* Rebecca Bellan 是 TechCrunch 的高级记者,报道人工智能的商业、政策和新兴趋势。她的作品也曾出现在《福布斯》、《彭博社》、《大西洋月刊》、《每日野兽》等媒体上。 您可以通过邮箱[[email protected]](mailto:[email protected])或通过 Signal 加密消息(rebeccabellan.491)联系或验证来自 Rebecca 的通讯。 [查看简介](https://techcrunch.com/author/rebecca-bellan/)

相似文章

Claude Sonnet 5

Hacker News Top

Anthropic 发布了 Claude Sonnet 5,这是一款高度自主的 AI 模型,在推理、工具使用和编码能力上有所提升,以更低的价格缩小了与 Opus 级别模型的差距。该模型现已面向所有套餐提供,并采用首发优惠定价。

推出 Claude Opus 5

Anthropic News

Anthropic 宣布推出 Claude Opus 5,这是一款强大且经济高效的 AI 模型,其智能水平接近 Claude Fable 5,但价格仅为后者的一半,在编程和知识工作基准测试中取得了最先进的结果。

新的GPT-5.6系列:Luna、Terra、Sol

Simon Willison's Blog

OpenAI发布了GPT-5.6系列,提供三种规格(Luna、Terra、Sol),具有更强的智能体性能、新的API功能(如程序化工具调用和多智能体支持),以及相比Claude模型更具竞争力的定价。