自选
我的自选
查看全部
市值 价格 24h%
  • 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

Anthropic 发布 Claude Opus 5:半价即享前沿性能

2026-07-27 21:01:51
收藏

Anthropic 发布 Claude Opus 5:以一半价格提供前沿性能

Anthropic 于 2026 年 7 月 24 日发布了 Claude Opus 5——这是继 6 月推出 Mythos 5、Fable 5 和 Sonnet 5 之后,不到两个月内的第四次模型发布。与以往强调能力上限不同,Anthropic 此次将发布重点放在经济性上:这是一款为日常使用而非仅应对最棘手问题而设计的模型。

定价与性能对比

Opus 5 的定价与其前代 Opus 4.8 相同,每百万输入 token 收费 5 美元,每百万输出 token 收费 25 美元——根据报道,这一价格恰好是 Anthropic 旗舰级 Fable 5 模型定价的一半。尽管价格更低,但在 Anthropic 发布时公布的多项基准测试中,Opus 5 的实际表现甚至优于 Fable 5——这对一家公司的次旗舰模型来说,是颇为罕见的局面。

买家关心的关键数据

在衡量智能编程能力的 Frontier-Bench v0.1 测试中,Opus 5 得分 43.3%,是 Opus 4.8(21.1%)的两倍多,并比紧随其后的模型高出约 10 个百分点。在测试新颖推理能力的 ARC-AGI-3 中,Opus 5 得分 30.2%,约为次优模型的三倍。此外,Anthropic 还引入了低/中/高三档计算强度开关,让开发者可以根据每次请求调整推理计算量,从而直接控制成本。

值得注意的细节

Anthropic 披露,其最受关注的编程基准测试采用了特定的内部测试框架,其中 Opus 4.8 作为 Opus 5 和 Fable 5 在安全分类器拒绝情况下的后备模型——这意味着公布的得分并非纯粹的单模型结果。Anthropic 已详细记录了该方法,但该测试框架由供应商自行运行,因此 43.3% 这一数字应结合此背景来理解,而非视为独立验证的数据。

在另一项编程基准测试 CursorBench 3.2 中,Opus 5 在最大计算强度下与 Fable 5 的最高得分相差不到 0.5 个百分点,而每次任务的成本却只有后者的一半。Anthropic 还报告称,Opus 5 的偏差评分低于其此前测量过的所有模型。

对买家的启示

目前使用 Opus 4.8 进行编程或智能体工作流的团队,可以在相同价格下获得显著的能力提升。Fable 5 在应对最困难任务时仍是前沿选择,但 Opus 5 以一半的成本弥补了大部分差距——在续签企业级 Fable 5 合约之前,值得先行测试。计算强度开关为财务和工程团队提供了直接管理 AI 支出的杠杆,无需切换整个模型。

展开阅读全文
更多新闻