Anthropic 在 2026 年 9 月 1 日推出 Claude Fable 5.1Claude Mythos 5.1,官方定位是「寫程式和知識工作最先進的模型」。三個重點一次看:更便宜(快取費用降 75%)、更少誤擋(Claude Code 資安誤擋少 60%)、科學研究能力翻倍。

這篇根據官方公告和技術文件,介紹 Fable 5.1 跟 Fable 5 差在哪、價格怎麼算、安全防護改了什麼,以及怎麼開始用。

跟 Fable 5 比,改了什麼

Fable 5.1 在三個面向有感升級。

科學研究能力翻倍

Anthropic 這次主打「長時間、多步驟的科學研究任務」有大幅提升。在 Terminal-Bench-Science(讓 AI 自己進行科學研究的跑分)裡,Fable 5.1 拿了 52.6%,是 Fable 5(24.7%)的兩倍多,也超過 Opus 5 和 OpenAI 的 GPT-5.6 Sol。Anthropic 甚至在發布前用它產出了三項原創科學發現,包括自定義 GPU 最佳化和金星表面地圖。

安全誤擋大減

Fable 5 推出時社群最大的抱怨就是「防護太敏感,正常使用也被擋」。5.1 針對這點做了大幅調整:

  • 資安方面:現在允許「發現漏洞」但禁止「開發攻擊程式」,比之前粗暴地一刀切精準很多。Claude Code 使用者每次工作階段的資安誤擋大約少了 60%
  • 生物安全方面:無害請求的誤擋減少了 85%

碰到真正敏感的問題時,資安類由 Opus 4.8 接手回答、生物類由 Opus 5 接手,而且接手的回答不另外收費,按 Fable 的價格計算。

費用更低

基礎價格不變,但快取讀取費用從每百萬 tokens 1 美元降到 0.25 美元,降幅 75%。實際效果:

  • 一般工作大約省 25%
  • 大量使用快取的 agent 任務最多省 45%

另外新增批次處理模式,輸入和輸出價格都是標準價的五折。

規格與價格一覽

整理自 Anthropic 官方文件:

項目內容
發布時間2026 年 9 月 1 日
Model IDclaude-fable-5-1
定位寫程式和知識工作最先進的公開模型
一次可讀內容量100 萬 tokens(約數十萬字)
單次最長輸出12.8 萬 tokens
思考模式永遠開啟的自動調整思考
API 輸入價格$10/百萬 tokens(不變)
API 輸出價格$50/百萬 tokens(不變)
快取讀取$0.25/百萬 tokens(降 75%
快取寫入(5 分鐘)$12.50/百萬 tokens
快取寫入(1 小時)$20/百萬 tokens
批次處理輸入 $5/輸出 $25(標準價五折)
使用管道claude.ai、Claude Code、API、AWS、Google Cloud、Microsoft Foundry

跟 Fable 5 比,基礎價格完全一樣(輸入 $10、輸出 $50),最大差異在快取讀取降了四倍。對用 Claude Code 跑長任務的人來說,agent 大量重複讀取上下文的場景剛好最受惠。

它有多強

Anthropic 官方 benchmark 對照表:Fable 5.1 在科學研究、寫程式、知識工作等項目與 Fable 5、Opus 5、GPT-5.6 Sol 的比較

把跑分項目翻成白話:

在測什麼Fable 5.1Fable 5Opus 5GPT-5.6 Sol
AI 自己做科學研究52.6%24.7%29.0%22.4%
在終端機寫程式55.8%42.0%52.3%37.3%
在 Cursor 編輯器寫程式73.4%70.5%70.0%67.2%
最難的通用推理(無工具)60.9%57.8%56.6%未測
最難的通用推理(有工具)65.0%63.8%63.6%未測
操作電腦桌面(嚴格)41.7%36.1%39.6%未測
自動化商業流程31.4%17.1%26.9%19.6%
知識工作綜合分1,8531,7231,8241,711

科學研究翻倍不用說了,自動化商業流程也從 17.1% 跳到 31.4%(接近翻倍),代表它在「幫你自動完成重複性工作」這件事上進步很大。

值得注意的是,某些跑分的差距其實沒那麼大。在 Cursor 編輯器寫程式(CursorBench)裡,四家模型的差距不到 6 個百分點;最難的通用推理(HLE 有工具版)只差 1.4 個百分點。真正拉開距離的是科學研究和自動化,以及在終端機寫程式方面 Fable 5.1 超越 Opus 5 的 52.3% 拿下 55.8%。

Anthropic 在跑分表下方也揭露了重要前提:Fable 5.1 帶著安全防護跑所有跑分,碰到安全敏感題會交給 Opus 4.8 或 Opus 5 回答,這可能拉低了它在某些項目的表現。

第三方的反應也滿正面。Jane Street Capital 量化研究主管說 Fable 5.1 在內部跑分解出比 Fable 5 和 Opus 5 更多的程式問題,而且「在交易直覺上達到了業界最強水準」。Cognition(做 AI 軟體工程師 Devin 的公司)則直接在上線當天就把 Opus 5 的流量切到 Fable 5.1,理由是快取降價後「Fable 等級的模型終於在成本上可行」。

Jane Street Capital 和 Cognition 對 Fable 5.1 的評價:程式能力超越前代,快取降價讓 Fable 等級模型的成本首次可行

隱形浮水印

Fable 5.1 新增了隱形文字浮水印:AI 生成的文字會被嵌入人眼看不見的標記,Anthropic 正在推出對應的偵測 API(目前是私人預覽階段)。主要動機是符合歐盟 AI 法規(EU AI Act)對 AI 生成內容的透明度要求。

對一般使用者來說,日常使用不會感覺到差異。但這代表未來有辦法驗證一段文字是不是由 Claude 寫的。

企業級隱私:零資料保留

Anthropic 同步宣布 Enterprise Frontier Safeguards 將在今年秋季上線,讓企業客戶可以在自己的基礎設施上執行模型,並選擇完全不保留資料。官方明確表示:「Anthropic 從未在未經明確許可的情況下使用企業資料訓練模型,未來也不會。」

預設情況下,Fable 5.1 會保留 30 天資料用於安全監控。企業版可以選擇由客戶自行管理基礎設施,並決定保留政策。

Mythos 5.1

Fable 5 和 Mythos 5 的關係一樣,Fable 5.1 和 Mythos 5.1 是同一個底層模型,差別在安全防護等級:

  • Fable 5.1:公開版,所有付費方案都能用。
  • Mythos 5.1:限定版,只開放給通過審核的機構。

5.1 新增了 Life Sciences Verification Program(生命科學驗證計畫),讓生醫研究機構也能申請使用 Mythos 5.1 的進階生物能力。原有的 Cyber Verification Program(資安驗證計畫)繼續運作。

官方提到 Mythos 5.1 在發布前已經成功設計出實驗驗證的蛋白質結合物,並最佳化了生物領域的深度學習模型。在終端機寫程式的跑分上,Mythos 5.1(60.9%)比 Fable 5.1(55.8%)更高,反映出去掉部分安全防護後的能力差距。

小企鵝的總結

  1. 防護調準比跑分提升更有感。 Fable 5 推出後社群最大的痛點是防護太敏感,正常使用也被擋。5.1 把資安誤擋砍了 60%、生物砍了 85%,這對日常使用的影響比跑分數字更直接。
  2. 快取降價打中最需要它的人。 快取讀取降 75% 看似只是 API 定價細節,但用 Claude Code 的人幾乎每次對話都在大量重複讀取上下文。省下來的帳很有感。
  3. 浮水印是遲早的事。 AI 生成內容的可追蹤性是歐盟法規在推的方向。Anthropic 搶先做,比被動等法規要求好。對一般使用者沒影響,但代表「AI 寫的能被驗證」這件事離主流又近了一步。
  4. 科學研究跑分翻倍很亮眼,但要觀察。 Terminal-Bench-Science 是新跑分,標準誤差有 ±3.5 到 4.5 個百分點,52.6% 本身不算特別高。不過方向很明確:Anthropic 想讓 Claude 成為科學研究的主力工具,不只是寫程式。

怎麼開始用

  • 已經在用 Fable 5 的人:API 把 model ID 改成 claude-fable-5-1。claude.ai 和 Claude Code 的選單應該已經更新。
  • 還沒用過 Fable 的人:需要 Pro、Max、Team 或 Enterprise 方案。建議先從自己最難的任務開始試,複雜度不夠的話 Opus 就夠用,帳單差很多。
  • 想用 Mythos 5.1:需要以機構身分申請 Cyber Verification Program 或 Life Sciences Verification Program。

延伸閱讀


整理:Penna|小企鵝 Penchan