Anthropic 在 2026 年 9 月 1 日推出 Claude Fable 5.1 和 Claude Mythos 5.1,官方定位是「写代码和知识工作最先进的模型」。三个重点一次看:更便宜(缓存费用下降 75%)、更少误拦(Claude Code 网络安全误拦减少 60%)、科学研究能力翻倍。
本文根据官方公告和技术文档,介绍 Fable 5.1 和 Fable 5 有什么不同、价格如何计算、安全防护改了什么,以及如何开始使用。
和 Fable 5 相比,改了什么
Fable 5.1 在三个方面有明显升级。
科学研究能力翻倍
Anthropic 这次主打「长时间、多步骤的科学研究任务」有大幅提升。在 Terminal-Bench-Science(让 AI 自己进行科学研究的跑分)中,Fable 5.1 拿到 52.6%,是 Fable 5(24.7%)的两倍多,也超过 Opus 5 和 OpenAI 的 GPT-5.6 Sol。Anthropic 甚至在发布前用它产出了三项原创科学发现,包括自定义 GPU 优化和金星表面地图。
安全误拦大幅减少
Fable 5 发布时,社区最大的抱怨就是「防护太敏感,正常使用也会被拦」。5.1 针对这一点做了大幅调整:
- 网络安全方面:现在允许「发现漏洞」,但禁止「开发攻击程序」,比之前粗暴的一刀切精准很多。Claude Code 用户每次工作会话的网络安全误拦大约减少 60%。
- 生物安全方面:无害请求的误拦减少了 85%。
遇到真正敏感的问题时,网络安全类由 Opus 4.8 接手回答,生物类由 Opus 5 接手,而且接手的回答不另外收费,按 Fable 的价格计算。
费用更低
基础价格不变,但缓存读取费用从每百万 tokens 1 美元降到 0.25 美元,降幅 75%。实际效果:
- 普通工作大约节省 25%
- 大量使用缓存的 agent 任务最多节省 45%
另外新增批处理模式,输入和输出价格都是标准价的五折。
规格与价格一览
整理自 Anthropic 官方文档:
| 项目 | 内容 |
|---|---|
| 发布时间 | 2026 年 9 月 1 日 |
| Model ID | claude-fable-5-1 |
| 定位 | 写代码和知识工作最先进的公开模型 |
| 一次可读内容量 | 100 万 tokens(约数十万字) |
| 单次最长输出 | 12.8 万 tokens |
| 思考模式 | 始终开启的自动调整思考 |
| API 输入价格 | $10/百万 tokens(不变) |
| API 输出价格 | $50/百万 tokens(不变) |
| 缓存读取 | $0.25/百万 tokens(下降 75%) |
| 缓存写入(5 分钟) | $12.50/百万 tokens |
| 缓存写入(1 小时) | $20/百万 tokens |
| 批处理 | 输入 $5/输出 $25(标准价五折) |
| 使用渠道 | claude.ai、Claude Code、API、AWS、Google Cloud、Microsoft Foundry |
和 Fable 5 相比,基础价格完全一样(输入 $10、输出 $50),最大差异在于缓存读取降到了四分之一。对于用 Claude Code 跑长任务的人来说,agent 大量重复读取上下文的场景正好最受益。
它有多强

把跑分项目翻成白话:
| 测试内容 | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| AI 自己进行科学研究 | 52.6% | 24.7% | 29.0% | 22.4% |
| 在终端中写代码 | 55.8% | 42.0% | 52.3% | 37.3% |
| 在 Cursor 编辑器中写代码 | 73.4% | 70.5% | 70.0% | 67.2% |
| 最难的通用推理(无工具) | 60.9% | 57.8% | 56.6% | 未测试 |
| 最难的通用推理(有工具) | 65.0% | 63.8% | 63.6% | 未测试 |
| 操作电脑桌面(严格) | 41.7% | 36.1% | 39.6% | 未测试 |
| 商业流程自动化 | 31.4% | 17.1% | 26.9% | 19.6% |
| 知识工作综合分 | 1,853 | 1,723 | 1,824 | 1,711 |
科学研究翻倍就不用说了,商业流程自动化也从 17.1% 跳到 31.4%(接近翻倍),说明它在「帮你自动完成重复性工作」这件事上进步很大。
值得注意的是,有些跑分的差距其实没那么大。在 Cursor 编辑器中写代码(CursorBench)时,四个模型的差距不到 6 个百分点;最难的通用推理(HLE 有工具版)只差 1.4 个百分点。真正拉开差距的是科学研究和自动化;在终端写代码方面,Fable 5.1 也以 55.8% 超过了 Opus 5 的 52.3%。
Anthropic 在跑分表下方也透露了一个重要前提:Fable 5.1 带着安全防护完成所有跑分,遇到安全敏感题会交给 Opus 4.8 或 Opus 5 回答,这可能拉低了它在某些项目上的表现。
第三方反应也相当积极。Jane Street Capital 量化研究主管表示,Fable 5.1 在内部跑分中解决的编程问题比 Fable 5 和 Opus 5 更多,而且「在交易直觉上达到业界最强水平」。Cognition(开发 AI 软件工程师 Devin 的公司)则在上线当天就把 Opus 5 的流量切换到 Fable 5.1,理由是缓存降价后「Fable 级别的模型终于在成本上可行」。

隐形文字水印
Fable 5.1 新增了隐形文字水印:AI 生成的文字会被嵌入人眼看不见的标记。Anthropic 正在推出对应的检测 API,目前处于私有预览阶段。主要动机是符合欧盟 AI 法规(EU AI Act)对 AI 生成内容透明度的要求。
对普通用户来说,日常使用不会感觉到差异。但这意味着未来可以验证一段文字是不是由 Claude 写的。
企业级隐私:零数据保留
Anthropic 同时宣布 Enterprise Frontier Safeguards 将在今年秋季上线,让企业客户可以在自己的基础设施上运行模型,并选择完全不保留数据。官方明确表示:「Anthropic 从未在未经明确许可的情况下使用企业数据训练模型,未来也不会。」
默认情况下,Fable 5.1 会保留 30 天数据用于安全监控。企业版可以选择由客户自行管理基础设施,并决定保留政策。
Mythos 5.1
和 Fable 5 与 Mythos 5 的关系一样,Fable 5.1 和 Mythos 5.1 是同一个底层模型,区别在于安全防护等级:
- Fable 5.1:公开版,所有付费套餐都能使用。
- Mythos 5.1:限定版,只开放给通过审核的机构。
5.1 新增了 Life Sciences Verification Program(生命科学验证计划),让生物医学研究机构也能申请使用 Mythos 5.1 的高级生物学能力。原有的 Cyber Verification Program(网络安全验证计划)继续运行。
官方提到,Mythos 5.1 在发布前已经成功设计出经过实验验证的蛋白质结合物,并优化了生物学领域的深度学习模型。在终端写代码的跑分中,Mythos 5.1(60.9%)高于 Fable 5.1(55.8%),反映出去掉部分安全防护后的能力差距。
小企鹅的总结
- 防护调校比跑分提升更有感。 Fable 5 发布后社区最大的痛点是防护太敏感,正常使用也会被拦。5.1 把网络安全误拦砍掉 60%、生物安全误拦砍掉 85%,对日常使用的影响比跑分数字更直接。
- 缓存降价正好打中最需要它的人。 缓存读取下降 75% 看似只是 API 定价细节,但 Claude Code 用户几乎每次对话都在大量重复读取上下文,省下的钱很有感。
- 水印迟早会出现。 AI 生成内容的可追踪性是欧盟法规推动的方向。Anthropic 抢先做,比被动等待法规要求更好。对普通用户没有影响,但代表「AI 写的内容可以被验证」这件事又离主流近了一步。
- 科学研究跑分翻倍很亮眼,但还要观察。 Terminal-Bench-Science 是新跑分,标准误差为 ±3.5 到 4.5 个百分点,52.6% 本身不算特别高。不过方向很明确:Anthropic 想让 Claude 成为科学研究的主力工具,而不只是写代码。
如何开始使用
- 已经在用 Fable 5 的人:把 API 的 model ID 改成
claude-fable-5-1。claude.ai 和 Claude Code 的菜单应该已经更新。 - 还没用过 Fable 的人:需要 Pro、Max、Team 或 Enterprise 套餐。建议先从自己最难的任务开始测试;如果复杂度不够,Opus 就够用了,账单会差很多。
- 想用 Mythos 5.1:需要以机构身份申请 Cyber Verification Program 或 Life Sciences Verification Program。
延伸阅读
整理:Penna|小企鹅 Penchan