Anthropic 发布 Claude Sonnet 5: 强化 Agentic 能力且定价更低
Anthropic 发布 Claude Sonnet 5 模型, 旨在提升 agentic 能力, 使其能自主制定计划、操作浏览器与终端。据 Anthropic 官方博文, 该模型在推理、工具使用和代码编写等关键 agentic 指标上较前代 Sonnet 4.6 有显著提升, 性能逼近 Opus 4.8 但成本更低。

Claude Sonnet 5 的 Agentic 能力提升
Claude Sonnet 5 定位于极强的 agentic 模型, 能够自主运行并执行复杂任务。此前, 这类高阶能力主要集中在昂贵的 Opus 系列模型中, 而 Sonnet 5 缩小了这一差距, 在推理、工具使用、代码编写和知识工作等维度表现出实质性进步。
在 BrowseComp(agentic 搜索评测) 与 OSWorld-Verified(计算机使用评测) 中,Sonnet 5 的表现严格优于 Sonnet 4.6。虽然在极高准确率要求下 Opus 4.8 仍是首选, 但 Sonnet 5 为开发者提供了高性价比的替代方案。早期合作伙伴反馈显示, 该模型在处理复杂任务时更不易中断, 并能无需指令地自主检查输出结果。

定价策略与可用性
Claude Sonnet 5 即日起面向所有计划开放, 成为 Free 和 Pro 计划的默认模型, 同时也支持 Max、Team 和 Enterprise 用户。该模型已接入 Claude Code 及 Claude Platform, 并可通过 claude-sonnet-5 API 调用。
其定价分为两个阶段:在 2026 年 8 月 31 日前的推广期, 定价为 2 美元/百万 input tokens 和 10 美元/百万 output tokens。推广期结束后, 标准定价将调整为 3 美元/百万 input tokens 和 15 美元/百万 output tokens。相比之下,Opus 4.8 的定价为 5 美元/百万 input tokens 和 25 美元/百万 output tokens。

安全性评估与网络安全防御
安全评估显示,Sonnet 5 的不当行为率低于 Sonnet 4.6, 在 agentic 场景下更安全。它在拒绝恶意请求、抵抗提示词注入 (prompt injection) 攻击方面表现更佳, 且幻觉与谄媚 (sycophancy) 现象有所减轻。
在网络安全能力方面,Anthropic 未对 Sonnet 5 进行专门的网络安全训练。在 Firefox 147 漏洞利用评测中,Sonnet 5 无法开发出完整的可用漏洞利用程序 (成功率 0.0%), 其能力远低于 Opus 4.8 和 Mythos 5。但由于其通用智能提升导致部分成功率略高于 Sonnet 4.6,Anthropic 已默认开启实时检测并拦截危险网络行为的防御机制。


Claude Sonnet 5 通过在成本与 Agentic 性能之间取得平衡, 降低了开发者构建自主智能体的门槛, 使其能够以更低价格实现接近 Opus 级别的复杂任务处理能力。

评论 0