304永利集团官网入口-刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜
首页财产ai正文 方才,Anthropic发布Sonnet 5,机能靠近Opus 4.8,但纷歧定更自制 Anthropic 刚发布全新模子 Claude Sonnet 5,称其为最具 Agent 属性的 Sonnet 模子,机能晋升且价格低,本日起可用并推出限时优惠。 2026-07-01 07:22 ·呆板之心 存眷AI的 存眷AI的 AI投资人解读· Anthropic发布的Claude Sonnet 5机能靠近Opus 4.8,但价格更低,比拟前代于推理等要害维度显著晋升,且安全评估总体有所改善。 · 与Opus 4.8等比拟,Sonnet 5于主动化举动审计中掉当举动率略高运行成本因token利用量增长而上升。 总结:Claude Sonnet 5依附机能上风与价格竞争力具有投资潜力,但需存眷安全与成本危害,建议联合行业数据进一步评估。
方才,Anthropic 正式发布了全新的模子Claude Sonnet 5,称其为「迄今为止最 具Agent 属性的 Sonnet 模子」,可以制订规划,利用阅读器、终端等东西,并以数月前还有需要更年夜、更昂贵模子才能到达的程度自立运行。
Sonnet 5 于推理、东西利用、编程及常识事情方面,比拟 Sonnet 4.6 机能有显著晋升,更靠近 Opus 4.8,但价格更低。

官方暗示,对于在开发者来讲,AI Agent 时代恰是从 Sonnet 级模子最先的:Claude Sonnet 3.五、3.6 及 3.7 是最早于编程及东西利用上揭示出亮眼能力的一批模子。不外近来一段时间,Agent 能力最较着的晋升重要呈现于 Opus 级模子上。
而 Claude Sonnet 5 较着缩小了这一差距:它的机能已经经靠近 Opus 4.8,但价格更低。比拟上一代 Sonnet 4.6,它于推理、东西利用、编程及常识事情等智能体机能要害维度上都有显著晋升。详细对于好比下图所示:

下图对于比了 Sonnet 5 与 Sonnet 4.六、Opus 4.8 于智能体搜刮评测 BrowseComp 及 computer use 评测 OSWorld‑Verified 上、在差别「努力水平」下的体现:
Sonnet 5(橙色线) 比拟 Sonnet 4.6(灰色线)具备明确的机能晋升,且笼罩的成本‑机能选项规模比 Opus 4.8(黄色线)更广。
于中等努力水平下,Sonnet 5 显著晋升了成本效率;于更高努力水平下,其机能于某些使命上可媲美 Opus 4.8。
于 Sonnet 5 及 Opus 4.8 之间,用户可按照详细使命矫捷调解努力水平,找到最合适自身需求的成本与机能均衡点。

差别努力水平下的成本 - 机能曲线如上图所示。此前最 好的 Sonnet 模子(Sonnet 4.6)远不和 Opus 4.8。Sonnet 5 提供了比 Sonnet 4.6 更广泛的成本 - 机能选项,于某些环境下可到达 Opus 4.8 的能力程度。图表中展示的 Sonnet 5 订价为输入 美金3 / 百万 token,输出 美金15 / 百万 token。经由过程 8 月 31 日前的尝鲜价(输入 美金2 / 百万 token、输出 美金10 / 百万 token),Sonnet 5 的现实成本甚至比图中显示的更低。Opus 4.8 的订价为输入 美金5 / 百万 token、输出 美金25 / 百万 token。

来自 Anthropic 初期拜候互助伙伴的反馈始终一致:Sonnet 5 比其前代模子更具自立智能体能力(agentic)。测试者描写说,它能完成繁杂使命 —— 而以前的 Sonnet 模子会于这些使命上半途止步;它会自动查抄本身的输出,无需明确提醒;并且它以极 具吸引力的价格完成所有这些智能体事情:

安全评估
Anthropic 的部署前安全评估发明,Sonnet 5 总体上比拟 Sonnet 4.6 有所改善。于自立智能体安全性方面,该模子于拒绝歹意哀求及抵御提醒注入进犯中的挟制测验考试方面体现更好。模子的幻觉率及谄媚举动率均低在 Sonnet 4.6。于主动化举动审计(测试规模广泛的掉当举动,如协助滥用及棍骗)中,Sonnet 5 患上分更低(即更安全)。
不外,与能力更强的 Opus 4.8 及 Claude Mythos Preview 比拟,它于该评估中确凿体现出略高的掉当举动率。

上图展示了主动化举动审计中的掉当举动率,该审计于多种情境及配景下测试年夜量不良举动(完备列表和各项举动成果见 Sonnet 5 体系卡第 6.4 节)。Sonnet 5 的掉当举动率总体低在 Sonnet 4.6,但高在 Mythos Preview 及 Opus 4.8。
Anthropic 暗示,他们并未决心针对于收集安全使命练习 Sonnet 5。它可以履行一些通例、无害的收集使命,但于评估潜于伤害收集技术(如开发软件缝隙使用步伐)时,其体现显著逊在 Opus 4.8 及 Mythos 5 等模子。
下图展示了此中一项评估的患上分,该评估测试了模子针对于 Firefox 阅读器缝隙开发使用步伐的能力。Sonnet 5 始终未能开发出完备可用的缝隙使用步伐,但其部门乐成率略高在 Sonnet 4.6。后者的晋升可能源在通用智能的改良,而非特定练习。

上图展示了模子针对于 Firefox 147 中软件缝隙乐成开发使用步伐的患上分(该评估与 Mozilla 互助开发;所有缝隙已经于 Firefox 148 中修复)。对于在每一个模子,左边柱状图暗示模子(于无安全护栏环境下)开发出可使用步伐的频率,右边柱状图暗示部门乐成的频率。两款 Sonnet 模子均未能乐成开发出可使用步伐(患上分均为 0.0%);Sonnet 5 的部门乐成率略高在 Sonnet 4.6。两款 Sonnet 模子的收集能力均显著弱在 Opus 4.8 及 Mythos 5。
因为 Sonnet 5 于这些使命上比其前代略有加强,Anthropic 已经默许启用了收集安全护栏。这些护栏 —— 可以或许及时检测并制止伤害的收集利用 —— 与 Claude Opus 4.7 及 4.8 中的不异(由于 Anthropic 判定 Sonnet 5 的总体收集安全危害较低,其护栏严酷水平低在 Fable 5 所启用的 —— 后者会制止更广泛的收集安全使命)。
Anthropic 对于 Sonnet 5 于多项安全及能力评估上的完备评估陈诉,详见 《Claude Sonnet 5 体系卡》。
订价
今天起,Claude Sonnet 5 已经于所有渠道正式可用。为庆祝发布,Anthropic 推出限时优惠首发价:
本日起至 2026 年 8 月 31 日:输入为 美金2 / 百万 token,输出为 美金10 / 百万 token
以后恢复尺度订价:输入 美金3 / 百万 token,输出 美金15 / 百万 token
与此同时,他们公布周全上调 Chat、Cowork、Claude Code 以和 Claude 平台的速度限定(rate limits),以适配更高「努力水平」模式带来的更年夜 token 耗损。
留意事项
收集安全验证
Sonnet 5 已经纳入 Anthropic 的「收集安全验证规划」。该规划现已经于如下平台开放利用:
Claude 原生平台
AWS 上的 Claude 平台
Microsoft Foundry 中的 Claude(托管在 Azure 及 Anthropic)
Google Vertex 上的 Claude 也将很快撑持。
已经插手该规划的构造,于 Sonnet 5 上主动得到划一拜候权限,无需从头申请。假如你的收集安全事情需要更少的安全护栏限定,Anthropic 保举利用 Claude Opus 4.8。
tokenizer 更新与订价申明
Sonnet 5 是 Sonnet 4.6 的进级版,但采用了全新的 tokenizer,以优化文本处置惩罚机能(这与 Claude Opus 4.7 引入的 tokenizer 变动近似)。
带来的变化是:不异输入内容,此刻会映照为更多 token,详细增幅约为 1.0~1.35 倍,视内容类型而定。
为此,Anthropic 设定的尝鲜价,恰是为了让用户过渡到 Sonnet 5 时,总体利用成本年夜致连结稳定。
速度限定调解申明
早于 2026 年 4 月 26 日,Anthropic 已经针对于 Sonnet 及 Haiku 模子,于所有利用层级上调高了速度限定,并将原生 Claude 平台的套餐简化为三个层级:Start、Build、Scale。
本次更新,Anthropic 进一步上调了 Chat、Cowork、Claude Code 和 Claude 平台的速度限定,以共同更高「努力水平」模式带来的更年夜 token 耗损。
您可以于 Claude Console 中查看当前层级及详细限定,或者查阅文档获取更多详情。
评测分数更正申明(增补)
Humanity’s Last Exam:Anthropic 更新了该评测的评分模子,并据此将 Sonnet 4.6 的分数批改为 34.6%(无东西) 及 46.8%(有东西)。是以,该分数与 Sonnet 4.6 发布博客中陈诉的数占有所差别,特此申明。
OSWorld‑Verified:Anthropic 优化了该评测的运行方式,以更真实地反应模子于现实场景中的体现,并将 Sonnet 4.6 的分数批改为 78.5%。这也是该分数与 Sonnet 4.6 发布博客中数据纷歧致的缘故原由。
开发者上手反馈
Claude Sonnet 5 一经发布,各人也已经经最先上手测评。
网友 Nicolas Bustamante 暗示,本身很喜欢 Sonnet 5 的一点于在,它速率很快,并且针对于 Agent 做了优化。「我最喜欢的例子是阅读器利用:又快,又安全。」
按照 system card 成果注解,阅读器利用场景下的提醒注入进犯乐成率,Sonnet 5 只有 0.93%,而 Opus 4.8 是 31.5%,Sonnet 4.6 是 50.7%。

不外也有网友暗示,「太贵了。」

而据 Artificial Analysis 阐发,于 Intelligence Index 上,Claude Sonnet 5 的运行成本为每一项使命 2.29 美元,比拟 Sonnet 4.6 增长约 2 倍,也比 Claude Opus 4.8 超出跨越约 15%。这一成本上升彻底由 token 利用量增长所驱动,使 Claude Sonnet 5 成为运行成本最高的模子之一,仅次在 Claude Fable 5。

那末你呢,感觉新模子怎样,接待评论区留言、交流!
参考链接:
https://x.com/claudeai/status/2072017450611142835
https://www.anthropic.com/news/claude-sonnet-5
https://x.com/ArtificialAnlys/status/2072062595482456431
【本文由投资界互助伙伴呆板之心授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-304永利集团官网入口




