Anthropic 在 2026 年 9 月 1 日推出 Claude Fable 5.1Claude Mythos 5.1,官方定位是「写代码和知识工作最先进的模型」。三个重点一次看:更便宜(缓存费用下降 75%)、更少误拦(Claude Code 网络安全误拦减少 60%)、科学研究能力翻倍。

本文根据官方公告和技术文档,介绍 Fable 5.1 和 Fable 5 有什么不同、价格如何计算、安全防护改了什么,以及如何开始使用。

和 Fable 5 相比,改了什么

Fable 5.1 在三个方面有明显升级。

科学研究能力翻倍

Anthropic 这次主打「长时间、多步骤的科学研究任务」有大幅提升。在 Terminal-Bench-Science(让 AI 自己进行科学研究的跑分)中,Fable 5.1 拿到 52.6%,是 Fable 5(24.7%)的两倍多,也超过 Opus 5 和 OpenAI 的 GPT-5.6 Sol。Anthropic 甚至在发布前用它产出了三项原创科学发现,包括自定义 GPU 优化和金星表面地图。

安全误拦大幅减少

Fable 5 发布时,社区最大的抱怨就是「防护太敏感,正常使用也会被拦」。5.1 针对这一点做了大幅调整:

  • 网络安全方面:现在允许「发现漏洞」,但禁止「开发攻击程序」,比之前粗暴的一刀切精准很多。Claude Code 用户每次工作会话的网络安全误拦大约减少 60%
  • 生物安全方面:无害请求的误拦减少了 85%

遇到真正敏感的问题时,网络安全类由 Opus 4.8 接手回答,生物类由 Opus 5 接手,而且接手的回答不另外收费,按 Fable 的价格计算。

费用更低

基础价格不变,但缓存读取费用从每百万 tokens 1 美元降到 0.25 美元,降幅 75%。实际效果:

  • 普通工作大约节省 25%
  • 大量使用缓存的 agent 任务最多节省 45%

另外新增批处理模式,输入和输出价格都是标准价的五折。

规格与价格一览

整理自 Anthropic 官方文档:

项目内容
发布时间2026 年 9 月 1 日
Model IDclaude-fable-5-1
定位写代码和知识工作最先进的公开模型
一次可读内容量100 万 tokens(约数十万字)
单次最长输出12.8 万 tokens
思考模式始终开启的自动调整思考
API 输入价格$10/百万 tokens(不变)
API 输出价格$50/百万 tokens(不变)
缓存读取$0.25/百万 tokens(下降 75%
缓存写入(5 分钟)$12.50/百万 tokens
缓存写入(1 小时)$20/百万 tokens
批处理输入 $5/输出 $25(标准价五折)
使用渠道claude.ai、Claude Code、API、AWS、Google Cloud、Microsoft Foundry

和 Fable 5 相比,基础价格完全一样(输入 $10、输出 $50),最大差异在于缓存读取降到了四分之一。对于用 Claude Code 跑长任务的人来说,agent 大量重复读取上下文的场景正好最受益。

它有多强

Anthropic 官方 benchmark 对照表:Fable 5.1 在科学研究、写代码、知识工作等项目中与 Fable 5、Opus 5、GPT-5.6 Sol 的比较

把跑分项目翻成白话:

测试内容Fable 5.1Fable 5Opus 5GPT-5.6 Sol
AI 自己进行科学研究52.6%24.7%29.0%22.4%
在终端中写代码55.8%42.0%52.3%37.3%
在 Cursor 编辑器中写代码73.4%70.5%70.0%67.2%
最难的通用推理(无工具)60.9%57.8%56.6%未测试
最难的通用推理(有工具)65.0%63.8%63.6%未测试
操作电脑桌面(严格)41.7%36.1%39.6%未测试
商业流程自动化31.4%17.1%26.9%19.6%
知识工作综合分1,8531,7231,8241,711

科学研究翻倍就不用说了,商业流程自动化也从 17.1% 跳到 31.4%(接近翻倍),说明它在「帮你自动完成重复性工作」这件事上进步很大。

值得注意的是,有些跑分的差距其实没那么大。在 Cursor 编辑器中写代码(CursorBench)时,四个模型的差距不到 6 个百分点;最难的通用推理(HLE 有工具版)只差 1.4 个百分点。真正拉开差距的是科学研究和自动化;在终端写代码方面,Fable 5.1 也以 55.8% 超过了 Opus 5 的 52.3%。

Anthropic 在跑分表下方也透露了一个重要前提:Fable 5.1 带着安全防护完成所有跑分,遇到安全敏感题会交给 Opus 4.8 或 Opus 5 回答,这可能拉低了它在某些项目上的表现。

第三方反应也相当积极。Jane Street Capital 量化研究主管表示,Fable 5.1 在内部跑分中解决的编程问题比 Fable 5 和 Opus 5 更多,而且「在交易直觉上达到业界最强水平」。Cognition(开发 AI 软件工程师 Devin 的公司)则在上线当天就把 Opus 5 的流量切换到 Fable 5.1,理由是缓存降价后「Fable 级别的模型终于在成本上可行」。

Jane Street Capital 和 Cognition 对 Fable 5.1 的评价:编程能力超过前代,缓存降价让 Fable 级别模型首次在成本上可行

隐形文字水印

Fable 5.1 新增了隐形文字水印:AI 生成的文字会被嵌入人眼看不见的标记。Anthropic 正在推出对应的检测 API,目前处于私有预览阶段。主要动机是符合欧盟 AI 法规(EU AI Act)对 AI 生成内容透明度的要求。

对普通用户来说,日常使用不会感觉到差异。但这意味着未来可以验证一段文字是不是由 Claude 写的。

企业级隐私:零数据保留

Anthropic 同时宣布 Enterprise Frontier Safeguards 将在今年秋季上线,让企业客户可以在自己的基础设施上运行模型,并选择完全不保留数据。官方明确表示:「Anthropic 从未在未经明确许可的情况下使用企业数据训练模型,未来也不会。」

默认情况下,Fable 5.1 会保留 30 天数据用于安全监控。企业版可以选择由客户自行管理基础设施,并决定保留政策。

Mythos 5.1

Fable 5 与 Mythos 5 的关系一样,Fable 5.1 和 Mythos 5.1 是同一个底层模型,区别在于安全防护等级:

  • Fable 5.1:公开版,所有付费套餐都能使用。
  • Mythos 5.1:限定版,只开放给通过审核的机构。

5.1 新增了 Life Sciences Verification Program(生命科学验证计划),让生物医学研究机构也能申请使用 Mythos 5.1 的高级生物学能力。原有的 Cyber Verification Program(网络安全验证计划)继续运行。

官方提到,Mythos 5.1 在发布前已经成功设计出经过实验验证的蛋白质结合物,并优化了生物学领域的深度学习模型。在终端写代码的跑分中,Mythos 5.1(60.9%)高于 Fable 5.1(55.8%),反映出去掉部分安全防护后的能力差距。

小企鹅的总结

  1. 防护调校比跑分提升更有感。 Fable 5 发布后社区最大的痛点是防护太敏感,正常使用也会被拦。5.1 把网络安全误拦砍掉 60%、生物安全误拦砍掉 85%,对日常使用的影响比跑分数字更直接。
  2. 缓存降价正好打中最需要它的人。 缓存读取下降 75% 看似只是 API 定价细节,但 Claude Code 用户几乎每次对话都在大量重复读取上下文,省下的钱很有感。
  3. 水印迟早会出现。 AI 生成内容的可追踪性是欧盟法规推动的方向。Anthropic 抢先做,比被动等待法规要求更好。对普通用户没有影响,但代表「AI 写的内容可以被验证」这件事又离主流近了一步。
  4. 科学研究跑分翻倍很亮眼,但还要观察。 Terminal-Bench-Science 是新跑分,标准误差为 ±3.5 到 4.5 个百分点,52.6% 本身不算特别高。不过方向很明确:Anthropic 想让 Claude 成为科学研究的主力工具,而不只是写代码。

如何开始使用

  • 已经在用 Fable 5 的人:把 API 的 model ID 改成 claude-fable-5-1。claude.ai 和 Claude Code 的菜单应该已经更新。
  • 还没用过 Fable 的人:需要 Pro、Max、Team 或 Enterprise 套餐。建议先从自己最难的任务开始测试;如果复杂度不够,Opus 就够用了,账单会差很多。
  • 想用 Mythos 5.1:需要以机构身份申请 Cyber Verification Program 或 Life Sciences Verification Program。

延伸阅读


整理:Penna|小企鹅 Penchan