星途科讯 42分钟前
Anthropic发布Opus 5:价格减半性能如何?
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

Anthropic 正式发布 Claude Opus 5 人工智能模型。官方宣称,该模型在智能水平接近前沿标准的同时,成本仅为 Claude Fable 5 的一半。对于深受代币(token)成本高企困扰的企业用户而言,这一降价策略极具吸引力。

定价与性能:高性价比对标竞品

在定价方面,Opus 5 的输入和输出价格统一为每百万代币 2.5 美元。相比之下,Fable 5 的定价为输入每百万代币 10 美元、输出每百万代币 50 美元;OpenAI 的 GPT-5.6 Sol 模型则为输入 5 美元、输出 30 美元。

尽管单价大幅降低,但评估实际成本还需考虑完成同一任务所需的代币数量。据 Artificial Analysis 数据显示,在 " 智能指数 " 任务中,各模型的加权平均成本分别为:Fable 5 为 2.75 美元,Opus 5(最大规格)为 2.03 美元,GPT-5.6 Sol(最大规格)为 1.04 美元,Kimi K3 为 0.95 美元。在智能指数得分上,Opus 5 以 61 分领先,仅比 Fable 5 高出 1 分。Anthropic 表示,Opus 5 在保持与前代 Opus 4.8 相同成本的前提下,实现了性能的大幅提升。

技术优化:上下文扩容与回复风格调整

通过对系统提示词进行精简,Opus 5 为用户留出了更多的上下文空间。Claude Code 工程师 Thariq Shihipar 透露,Anthropic 在新模型中移除了 80% 的 Claude Code 系统提示词内容。他建议开发者在编写提示词、技能指令及 CLAUDE.md 文件时同步进行简化,并可利用 `claude doctor` 命令辅助优化。

值得注意的是,Opus 5 的默认回复长度较前代模型有所增加。Anthropic 警告称,若用户不希望出现这种冗长风格,需在提示词中明确要求控制回复长度,否则可能面临更高的费用支出。

安全与应用:降低拒绝率,增强企业友好度

在开源代码漏洞挖掘方面,Opus 5 表现强劲。在 OSS-Fuzz 基准测试中,其得分为 80%,略高于 Mythos 模型的 79.4%。然而,在漏洞武器化利用方面,Opus 5 明显较弱:14 次尝试中仅成功 4 次,而 Mythos 的成功率高达 13/14。

系统卡片显示,Opus 5 在代理编程、计算机使用和长周期知识工作领域的提升最为显著,整体性能可与 Fable 5 媲美,部分场景下甚至超越 Fable 5 及 Claude Mythos 5。由于网络分类器限制比例低于 Fable 5,Opus 5 在网络安全和生物学任务中的拒绝率大幅降低,允许查找源代码漏洞,但仍会阻止基于二进制的漏洞扫描、渗透测试及漏洞利用生成。

为解决模型拒绝服务带来的困扰,Anthropic 在 API 中引入了自动回退功能。当请求被判定为过于危险而不适合由 Opus 5 或 Fable 5 处理时,系统将自动将其路由至能力较弱的其他模型,而非直接阻断。官方称,Opus 5 是 Anthropic 迄今为止 " 对齐度最高 " 的模型,最难突破安全护栏。此外,该模型支持无数据保留模式,进一步提升了其对 enterprise 客户的吸引力。

【星途科讯 图文丨 LCC 首发于 ZAKER 科技,转载请注明出处】

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

人工智能 kimi 技能 编程 开源
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论