
Anthropic 发布 Claude Opus 5:近 Fable 级别的智能,一半的价格
Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,全新旗舰模型在编码、科学研究和知识工作等多项基准上超越前代 Opus 4.8 近两倍性能,定价仅为 Fable 5 的一半
原文来源:Anthropic Blog — Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,在多项基准测试中接近 Fable 5 的智能水平,但成本仅为其一半,适合日常高频使用。
Anthropic 昨日正式发布了 Claude Opus 5,这是 Opus 系列的最新旗舰模型。与上一代 Opus 4.8 相比,Opus 5 在多个关键基准测试上实现了性能翻倍甚至更多的提升,同时定价仅为顶级模型 Fable 5 的一半。Anthropic 称其为"一个有思想、主动解决问题的模型"。
性能飞跃:不止是量变
Claude Opus 5 在多项编码基准上表现惊人。在 Frontier-Bench v0.1 上,它不仅全面超越所有竞品模型,性能更是 Opus 4.8 的两倍以上,而单任务成本反而更低。在 CursorBench 3.2(最大努力模式下),Opus 5 距离 Fable 5 的峰值仅差 0.5%,但成本少了一半。
更值得注意的是 ARC-AGI 3 上的成绩——这个测试衡量模型解决全新问题的能力,Opus 5 的得分是次优模型的三倍。这个差距不是渐进式改进,而是代际跨越。
在自动化能力方面,Zapier AutomationBench 上 Opus 5 的通过率是次优模型的 1.5 倍(同等成本下)。即便在最省钱的低努力模式下,它完成的任务也比其他模型在最高努力模式下多。在 OSWorld 2.0(桌面操作任务)上,Opus 5 以仅 Fable 5 三分之一的成本超越了 Fable 5 的最佳成绩。
—— 广告 ——
科学研究:生命科学领域的实际提升
对科研人员来说,Opus 5 在生命科学全部评估维度上相比 Opus 4.8 都有实质性提升:
- 有机化学(从光谱推断分子结构):提升 10.2 个百分点
- 蛋白质相关任务(预测序列变异对功能的影响):提升 7.7 个百分点
- 在结构生物学、生物信息学等子领域也有显著进步
早期测试用户中,一家基因组学实验室的评价很有意思:Opus 5 的行为方式"更像一个细心的科学家",会自动选择合适的统计检验方法排除混淆变量,交叉验证自己的结果,在多步骤长链条分析中保持方向感。
创造力与视觉能力
除了基准测试,Anthropic 还展示了 Opus 5 的创造力。它构建了一个可交互的风洞可视化(模拟气流经过物体时的流动模式),还创建了一个 3D 交互式动物细胞模型。V0(Versus)团队的评价很直白:"这是 Opus 系列自 4.5 以来最大的一次跨越,做动画、游戏和 3D 的能力是我们见过的 Opus 模型里最好的。"
早期用户的真实反馈
多家与 Anthropic 深度合作的公司分享了他们的实测数据:
- Devin:"在 FrontierCode 1.1 上,Claude Opus 5 以一半的成本达到了接近 Fable 的水平,尤其擅长困难调试和根本原因分析。"
- Cursor:"Opus 5 提供了 Fable 级别的智能,但速度是 Opus 级别。在 CursorBench 上只比 Fable 5 差一点,行为模式也很相似。"
- Zapier:"Opus 5 登顶了 AutomationBench 排行榜。我们给它一个原始的客户健康工作簿,它自己完成了完整的流失预防流程——之前的模型一个都没通过,Opus 5 一次做到了 100%。"
- Lovable:"在难度最高的 Agent 编码任务上比 Opus 4.7 提升了 22%,而且每次运行之间的方差大大降低——一致性才是关键。"
- S&P Global:"在我们一些最难的金融建模任务上,平均精度提升了 9 个百分点,而交互轮次和工具调用减少了三分之一,耗时降低了 60%。"
- Box:"整体比 Opus 4.8 提升 8%,数据分析提升 11%,尽职调查提升 17%。"
- Notion:"它能处理我们通常需要拆成小块来做的代码库大规模改动。"
- Wix:"会像真正的前端开发者那样自我检查——它发现了一个藏在移动端折叠线以下的 Bug。"
- 一位个体用户:"花了一个周末让它当我的幕僚长,它自己建了监控面板,驱策每个环节,只在需要判断力的时候叫我。"
主动性与彻底性:一个画图引发的思考
Anthropic 展示了一个令人印象深刻的案例:给 Opus 5 一张机械零件的图纸,但没有直接展示零件本身。它自己写了一套计算机视觉管线,从原始像素中提取几何数据,然后重建了完整的 3D FreeCAD 模型。其他竞品模型尝试五次都未能解决。
在 Bug 修复方面,Opus 5 找到了一个流行开源包管理器中的真实 Bug 的根因,并修复了一个社区补丁遗漏的边缘情况。竞品模型只修复了表面症状。
价格与可用性
Claude Opus 5 即日起可用:
- Claude Max:默认模型
- Claude Pro:最强模型选项
- API:定价为 Fable 5 的一半
Anthropic 用一句话总结了 Opus 5 的定位:它不是一个实验室里为了刷榜而生的怪物,而是一个可以每天都用、用得起的日常智能助手。对于那些需要 Fable 级别的能力但预算有限团队来说,这可能就是他们一直等的那款模型。
© 2026 四月
原文链接:https://www.aprilzz.com/ai/claude-opus-5
相关文章
Claude Fable 5 和 Mythos 5 发布:Anthropic 迄今最强模型,以安全护栏释放前沿能力
2026 年 6 月 9 日,Anthropic 发布 Claude Fable 5(面向公众的 Mythos 级模型)和 Claude Mythos 5(增强版)。新模型在几乎所有 AI 能力基准上实现 SOTA,定价仅为 Mythos Preview 的一半。
Claude Opus 4.8 正式发布:Anthropic 迄今最强模型,Agent 能力大幅提升
2026 年 5 月 28 日,Anthropic 发布 Claude Opus 4.8。新模型在编程、Agent、推理等全面超越前代,推出 Effort Control 和动态工作流功能,定价不变。
Claude Opus 4.7 发布:进阶软件工程能力的新里程碑
Anthropic 于 2026 年 4 月 16 日发布 Claude Opus 4.7,这是 Opus 4.6 的重大升级,在复杂软件工程任务上表现突出,支持 1M token 上下文、128K 输出,定价保持不变。