一句話重點

Anthropic 在 2026 年 9 月 22 日推出新款 AI 模型 Claude Opus 5.5,是 Claude 5.5 系列的第一款。官方稱它在多數工作上達到 Fable 5.1 的水準,預設設定下比 Opus 5 省約 4 成成本。 如果你平常用 Claude Code 寫程式,或是透過 API 付費使用 Claude,這次升級值得認識一下。Claude 目前分成 Fable、Opus、Sonnet、Haiku 幾個系列(截至 2026 年 9 月),能力和價格由高到低排列,Opus 5.5 屬於中高階,主打長時間、會自己動手做事的工作。API 價格是每百萬 token 輸入 4 美元、輸出 20 美元,比 Opus 5 的 5/25 美元便宜,model ID 是 claude-opus-5-5

這次升級重點

這次升級改了幾件事,一般使用者最該知道的是這幾點:

  • 多數工作達到 Fable 5.1 水準:Fable 5.1 是價格更高的高階模型(API 每百萬 token 輸入 10、輸出 50 美元)。官方稱多數工作達到 Fable 5.1 水準,價格卻便宜很多。Anthropic 自己也提醒,到了這個能力等級,跑分差距已經不太能反映實際使用上的差異。
  • 更便宜:在 Terminal-Bench 這項寫程式測試裡,預設力度就贏過 Opus 5 開到最高的分數,成本大約五分之一(官方圖說)。
  • 輸出更快:生成速度比 Opus 5 快 3 成以上(官方數字)。
  • 預設思考力度調低:Claude 回答前會先「想」一下,想得越深通常越準,但也越慢越貴。這個力度分成好幾個等級,Opus 5.5 預設用中等力度(medium),Opus 5 預設用較高的力度(high),需要的話都可以自己手動調高。
  • Claude Code 預設換人:根據 Claude Code 的更新紀錄,用 Pro 或 Team Standard 方案的 Claude Code,預設模型已經從 Sonnet 換成 Opus,不用自己手動選。

跑分怎麼看

Claude Opus 5.5 官方 benchmark 對照表:與 Fable 5.1、Opus 5、GPT-6 Astra、GPT-5.6 Sol 在九項測試的比較,Opus 5.5 多數項目領先,AutomationBench 和 Terminal-Bench-Science 落後 GPT-6 Astra
圖片來源:Anthropic

跑分是什麼?簡單說,就是拿同一組任務讓不同模型做,再依表現打分數,分數越高代表那項工作做得越好。

官方公布的九項測試裡,Opus 5.5 在七項拿下表中最高分(其中三項 GPT-6 Astra 沒有公布分數,GPT 模型的分數由 OpenAI 自行回報),包括讓 AI 自己在終端機裡寫程式的測試(Terminal-Bench 4.0)拿下 66.4%、知識工作類測試(GDPval-AA v2.1)拿下 1846 分。輸給的兩項都是 GPT-6 Astra:自動化商業流程測試(AutomationBench)40.0% 對 41.4%,以及科學研究類測試(Terminal-Bench-Science)58.7% 對 64.6%。Anthropic 自己也提醒,模型能力到了這個等級,跑分的差距已經不太能反映真實使用時的感覺。

價格與方案

Claude Opus 5.5 與 Opus 5 的價格對照表:輸入、輸出、快取讀取三項費用
圖片來源:Anthropic
項目Opus 5.5Opus 5
輸入$4/MTok$5/MTok
輸出$20/MTok$25/MTok
快取讀取$0.20/MTok$0.50/MTok

上面這張表的單位是「每百萬 token」(MTok)。打個比方,如果一個任務用了 100 萬個輸入 token、又生成了 100 萬個輸出 token,用 Opus 5.5 大約要花 24 美元(4 加 20),用 Opus 5 則要花 30 美元(5 加 25)。快取讀取指的是重複使用同一段對話內容時的收費,通常比第一次輸入便宜很多,用 Claude Code 跑長任務、常常回頭讀同一份資料的人會很有感。

誰能用:如果你是 claude.ai 的 Pro、Max、Team 或 Enterprise 訂閱用戶,可以直接在模型選單裡選 Opus 5.5;免費方案目前還不能用(截至 2026 年 9 月)。開發者則可以透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 取得。GitHub 表示,Copilot 的付費用戶(Pro+、Max、Business、Enterprise)也能選用,正在逐步開放。

要注意的是,上面這張價目表是給開發者透過 API 串接時看的計費方式;如果你是訂閱 claude.ai 的 Pro、Max 這類方案,是每月固定收費,不用自己算 token,只是用量有上限。兩種付費方式不一樣,別搞混了。

開發者要注意的變更

以下是給有在寫程式、串 API 的開發者看的,一般使用者可以直接跳過:

  • thinking 關不掉:以前可以用參數關閉「思考」,Opus 5.5 不行,硬關會直接回傳錯誤。
  • 強制指定工具會出錯:以前可以強制要求模型一定要呼叫某個工具,Opus 5.5 這樣設定會出錯,改用自動判斷還是正常。
  • thinking blocks 綁定模型:Opus 5.5 讀得懂舊版 Opus 留下的思考紀錄,但讀不懂 Fable 留下的,跨模型混用要注意。
  • 舊版 computer use 工具失效:在 Claude API 和 Google Cloud 上,操作電腦畫面用的舊版工具已經停用,要換新版。

安全重點

Anthropic 每次發新模型都會公布一份幾百頁的「系統卡」,說明這款模型做過哪些安全測試、有哪些風險。不用整份讀完,這次的重點是:

  • 對齊測試表現亮眼:系統卡說,Opus 5.5 做出「不對齊」行為(偏離人類期望、可能配合濫用)的比例,是近期 Claude 模型裡最低的。
  • 貼上文字的提示注入退步:如果你把一段文字貼進對話裡,裡面藏著惡意指令,Opus 5.5 比以前的模型更容易照做;不過加上官方的防護措施後,基本上不會照做。
  • 敏感任務自動轉模型:在 Claude 的 App 裡,問到資安或生物相關的敏感問題時,系統會自動把對話轉給 Opus 4.8 或 Opus 5 回答,畫面上會提示已經換模型,不會偷偷發生。

小企鵝的總結

老實說,小企鵝玩了一天 Opus 5.5,有點感動到。它總算回到 Opus 4.6 那種好溝通的感覺,不像 Opus 5 講話跟機器人一樣。拿來指揮其他 agent(orchestration)也特別順,終於可以讓它自己 spawn subagents(派出子 agent)分頭做事,這點 Opus 4.6 就比較笨拙。token 也用得比較省。最有感的是,回覆裡那些奇怪的「—」終於不見了 😭

接下來小企鵝會繼續測試 Opus 5.5,有新心得再發上來。

受益最直接的是兩種人:透過 API 付 Opus 5 價格的人,以及用 Pro 或 Team Standard 方案 Claude Code 的人,後者的預設模型已經換成 Opus。開發者記得重新測一次 effort 等級,不要直接沿用舊設定,也留意那四個破壞性變更。免費方案的使用者目前還用不到 Opus 5.5(截至 2026 年 9 月)。

本文為 AI 模型 API 計費與訂閱方案的消費資訊,不涉及證券或投資建議。實際定價以 Anthropic 官方最新公告為準,本文資訊截至 2026 年 9 月 23 日,可能已過時。

延伸閱讀

參考資料

封面圖片來源:Anthropic(anthropic.com/claude-opus-5-5)