AI 前沿·阅读约 2 分钟·
Claude Fable 5.1 发布:缓存读取降价 75%,同样价格买到更强的 Agent 模型

Claude Fable 5.1 发布:缓存读取降价 75%,同样价格买到更强的 Agent 模型

9 月 1 日 Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:缓存读取降价 75%($0.25/百万 token),典型工作负载整体便宜 25%,长时程 Agent 任务最高省 45%。性能全面超越 Fable 5,并首次把『漏洞发现』纳入通用护栏。

原文来源:Anthropic 官方博客 — 距 Fable 5 发布 12 周后,Anthropic 用降价和护栏优化把最强的 Mythos 级能力正式推向所有用户。

9 月 1 日,Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1。两者是同一个模型、两套安全护栏:Fable 5.1 面向所有用户开放,Mythos 5.1 只通过可信访问计划提供给网络安全与生命科学领域的授权机构。对普通开发者来说,这次更新的重点不是又刷了多少分,而是 Anthropic 第一次认真回应了客户对价格和隐私的抱怨——缓存读取价格直接砍掉 75%,长时程 Agent 任务的账单能省近一半。

价格:同样的 $10/$50,账单少四分之一

Fable 5.1 的单价没有变,仍是每百万输入 token $10、每百万输出 token $50,变的是缓存读取。所谓缓存读取,是模型重复读取已经处理过的上下文时的计费项,在 Agent 反复调用工具、多次轮询的长任务里,这一项往往占账单的大头。Anthropic 把缓存读取从每百万 token $1 降到 $0.25,降幅 75%。

按官方口径,典型工作负载的总成本因此下降约 25%;高度 Agentic 的工作(上下文反复复用、工具调用密集)省得更多,最高约 45%。之前很多团队把长时程任务留在 Opus 上,就是嫌 Fable 级别的缓存太贵——这次降价后,Cognition 直接把 Devin 里的 Opus 5 流量在发布当天切到了 Fable 5.1。

—— 广告 ——

EFS:企业级"零数据保留"新方案

数据保留是这次更新的第二块拼图。Anthropic 推出了一套叫 Enterprise Frontier Safeguards(EFS)的机制:模型推理所需的数据存储在客户自己控制的云基础设施里,而不是 Anthropic 的服务器上,从而在保留前沿安全能力的同时做到真正的零数据保留。EFS 今年秋天开始分批开放给企业客户;在那之前,符合条件的客户可以直接用零数据保留模式跑 Fable 5.1。

对处理敏感代码和客户数据的团队来说,这解决了过去"要么交数据、要么放弃能力"的两难。

护栏:误报少 60%,漏洞发现被放行

Fable 5.1 的护栏做了两处重要调整。一是大幅降低误报率:网络安全领域的误报比之前少 60%。二是能力边界的变化——Fable 5.1 现在可以用于发现软件漏洞(finding vulnerabilities),只是仍不能开发对应的利用程序(exploits)。生物安全方面,Anthropic 与美国政府合作建立了访问计划,允许授权科学家使用 Mythos 5.1 的高级生物学能力,注册通道近期开放。

这两条合起来的意思很明确:模型太强了,Anthropic 选择把"防守侧"的能力(找漏洞、做科研)放开,把"进攻侧"的能力(写利用代码、合成生物威胁)继续锁在可信计划里。

性能:每个维度都明显超过 Fable 5

Anthropic 给出的对比数据(Fable 5.1 vs Fable 5 vs Opus 5):

基准Fable 5.1Fable 5Opus 5
Terminal-Bench 4.0(终端编码)55.8%42.0%52.3%
Terminal-Bench-Science 0.1(科学任务)52.6%24.7%29.0%
AutomationBench(自动化工作流)31.4%17.1%26.9%
CursorBench 3.2.0(编辑器编码)73.4%70.5%70.0%
HLE 无工具(跨学科推理)60.9%57.8%56.6%
HLE 带工具65.0%63.8%63.6%
OSWorld 2.0(计算机操作,宽松计分)77.9%72.9%75.4%
GDPval-AA v2(知识工作)185317231824

Mythos 5.1(解锁全部能力)在 Terminal-Bench 4.0 上跑到 60.9%,比 Fable 5.1 高 5 个百分点——这个差距基本就是护栏介入的代价。Fable 5.1 在 OSWorld 和 AutomationBench 上被护栏干预过的任务直接记零分,官方也承认这拉低了成绩,所以实际能力比数字更好看。

注意 HLE 上 Fable 5.1 无工具 60.9% 已经超过 Opus 5 的 56.6%,带工具 65.0% 也领先——一个非旗舰型号在推理上压过自家上一代旗舰,这在新模型发布里不常见。

长期任务的"靠谱"才是这次真正的卖点

几组早期合作伙伴的反馈比基准数字更有信息量:

  • Millennium(投资公司):一个约百万分之一概率触发的罕见崩溃,团队工程师四年多没查出来,Fable 5.1 反汇编了外部供应商的库、对照 core dump,把根因定位到那个库的 bug。
  • Jane Street:内部基准上 Fable 5.1 解决的编码问题比 Fable 5 和 Opus 5 都多;关键改进是"模型工作时间越长越容易跑偏"的老毛病没了,多步长任务里输出始终可读。
  • Ramp:一次无人值守的 38 小时机器学习任务,模型自己把之前的结论诊断为标注伪影、修正后并行跑了六个实验,第二天带着结果和下一步建议回来。
  • MongoDB:三天内完成一个复杂原型,先调研全部服务代码与文档给出设计,再无人值守跑数小时实现,早上起来看到下一阶段已经完成。

Fable 5.1 默认在 Claude Code 里用 High effort、在 Claude Cowork 和 Claude.ai 里用 Medium。如果你的 Agent 工作流正卡在"模型跑长了就丢上下文"或"缓存账单太贵"这两个问题上,这可能是今年最值得切换的一次点版本更新。

分享到
微博Twitter

© 2026 四月

原文链接:https://www.aprilzz.com/ai/claude-fable-5-1-mythos-5-1