
Claude Fable 5.1 发布:缓存读取降价 75%,同样价格买到更强的 Agent 模型
9 月 1 日 Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:缓存读取降价 75%($0.25/百万 token),典型工作负载整体便宜 25%,长时程 Agent 任务最高省 45%。性能全面超越 Fable 5,并首次把『漏洞发现』纳入通用护栏。
原文来源:Anthropic 官方博客 — 距 Fable 5 发布 12 周后,Anthropic 用降价和护栏优化把最强的 Mythos 级能力正式推向所有用户。
9 月 1 日,Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1。两者是同一个模型、两套安全护栏:Fable 5.1 面向所有用户开放,Mythos 5.1 只通过可信访问计划提供给网络安全与生命科学领域的授权机构。对普通开发者来说,这次更新的重点不是又刷了多少分,而是 Anthropic 第一次认真回应了客户对价格和隐私的抱怨——缓存读取价格直接砍掉 75%,长时程 Agent 任务的账单能省近一半。
价格:同样的 $10/$50,账单少四分之一
Fable 5.1 的单价没有变,仍是每百万输入 token $10、每百万输出 token $50,变的是缓存读取。所谓缓存读取,是模型重复读取已经处理过的上下文时的计费项,在 Agent 反复调用工具、多次轮询的长任务里,这一项往往占账单的大头。Anthropic 把缓存读取从每百万 token $1 降到 $0.25,降幅 75%。
按官方口径,典型工作负载的总成本因此下降约 25%;高度 Agentic 的工作(上下文反复复用、工具调用密集)省得更多,最高约 45%。之前很多团队把长时程任务留在 Opus 上,就是嫌 Fable 级别的缓存太贵——这次降价后,Cognition 直接把 Devin 里的 Opus 5 流量在发布当天切到了 Fable 5.1。
—— 广告 ——
EFS:企业级"零数据保留"新方案
数据保留是这次更新的第二块拼图。Anthropic 推出了一套叫 Enterprise Frontier Safeguards(EFS)的机制:模型推理所需的数据存储在客户自己控制的云基础设施里,而不是 Anthropic 的服务器上,从而在保留前沿安全能力的同时做到真正的零数据保留。EFS 今年秋天开始分批开放给企业客户;在那之前,符合条件的客户可以直接用零数据保留模式跑 Fable 5.1。
对处理敏感代码和客户数据的团队来说,这解决了过去"要么交数据、要么放弃能力"的两难。
护栏:误报少 60%,漏洞发现被放行
Fable 5.1 的护栏做了两处重要调整。一是大幅降低误报率:网络安全领域的误报比之前少 60%。二是能力边界的变化——Fable 5.1 现在可以用于发现软件漏洞(finding vulnerabilities),只是仍不能开发对应的利用程序(exploits)。生物安全方面,Anthropic 与美国政府合作建立了访问计划,允许授权科学家使用 Mythos 5.1 的高级生物学能力,注册通道近期开放。
这两条合起来的意思很明确:模型太强了,Anthropic 选择把"防守侧"的能力(找漏洞、做科研)放开,把"进攻侧"的能力(写利用代码、合成生物威胁)继续锁在可信计划里。
性能:每个维度都明显超过 Fable 5
Anthropic 给出的对比数据(Fable 5.1 vs Fable 5 vs Opus 5):
| 基准 | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0(终端编码) | 55.8% | 42.0% | 52.3% |
| Terminal-Bench-Science 0.1(科学任务) | 52.6% | 24.7% | 29.0% |
| AutomationBench(自动化工作流) | 31.4% | 17.1% | 26.9% |
| CursorBench 3.2.0(编辑器编码) | 73.4% | 70.5% | 70.0% |
| HLE 无工具(跨学科推理) | 60.9% | 57.8% | 56.6% |
| HLE 带工具 | 65.0% | 63.8% | 63.6% |
| OSWorld 2.0(计算机操作,宽松计分) | 77.9% | 72.9% | 75.4% |
| GDPval-AA v2(知识工作) | 1853 | 1723 | 1824 |
Mythos 5.1(解锁全部能力)在 Terminal-Bench 4.0 上跑到 60.9%,比 Fable 5.1 高 5 个百分点——这个差距基本就是护栏介入的代价。Fable 5.1 在 OSWorld 和 AutomationBench 上被护栏干预过的任务直接记零分,官方也承认这拉低了成绩,所以实际能力比数字更好看。
注意 HLE 上 Fable 5.1 无工具 60.9% 已经超过 Opus 5 的 56.6%,带工具 65.0% 也领先——一个非旗舰型号在推理上压过自家上一代旗舰,这在新模型发布里不常见。
长期任务的"靠谱"才是这次真正的卖点
几组早期合作伙伴的反馈比基准数字更有信息量:
- Millennium(投资公司):一个约百万分之一概率触发的罕见崩溃,团队工程师四年多没查出来,Fable 5.1 反汇编了外部供应商的库、对照 core dump,把根因定位到那个库的 bug。
- Jane Street:内部基准上 Fable 5.1 解决的编码问题比 Fable 5 和 Opus 5 都多;关键改进是"模型工作时间越长越容易跑偏"的老毛病没了,多步长任务里输出始终可读。
- Ramp:一次无人值守的 38 小时机器学习任务,模型自己把之前的结论诊断为标注伪影、修正后并行跑了六个实验,第二天带着结果和下一步建议回来。
- MongoDB:三天内完成一个复杂原型,先调研全部服务代码与文档给出设计,再无人值守跑数小时实现,早上起来看到下一阶段已经完成。
Fable 5.1 默认在 Claude Code 里用 High effort、在 Claude Cowork 和 Claude.ai 里用 Medium。如果你的 Agent 工作流正卡在"模型跑长了就丢上下文"或"缓存账单太贵"这两个问题上,这可能是今年最值得切换的一次点版本更新。
© 2026 四月
原文链接:https://www.aprilzz.com/ai/claude-fable-5-1-mythos-5-1
相关文章
Claude Opus 4.8 正式发布:Anthropic 迄今最强模型,Agent 能力大幅提升
2026 年 5 月 28 日,Anthropic 发布 Claude Opus 4.8。新模型在编程、Agent、推理等全面超越前代,推出 Effort Control 和动态工作流功能,定价不变。
Gemini 3.7 Flash 发布:编码与 Agent 能力大涨,价格直接腰斩
距 3.6 Flash 仅三周,Google 发布 Gemini 3.7 Flash:FrontierCode 得分 43.6%、DeepSWE 65.3%、WebDev Arena Elo 1588,入门价降到每百万 token 0.75 美元,是 3.6 的一半。
DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了
8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。