一句话重点
Anthropic 在 2026 年 9 月 22 日推出新款 AI 模型 Claude Opus 5.5,是 Claude 5.5 系列的第一款。官方称它在多数工作上达到 Fable 5.1 的水平,默认设置下比 Opus 5 省约 4 成成本。 如果你平常用 Claude Code 编程,或者通过 API 付费使用 Claude,这次升级值得了解一下。Claude 目前分成 Fable、Opus、Sonnet、Haiku 几个系列(截至 2026 年 9 月),能力和价格由高到低排列,Opus 5.5 属于中高阶,主打长时间、会自己动手做事的工作。API 价格是每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 的 5/25 美元便宜,model ID 是 claude-opus-5-5。
这次升级重点
这次升级改了几件事,一般用户最应该知道的是这几点:
- 多数工作达到 Fable 5.1 水平:Fable 5.1 是价格更高的高阶模型(API 每百万 token 输入 10、输出 50 美元)。官方称多数工作达到 Fable 5.1 水平,价格却便宜很多。Anthropic 自己也提醒,到了这个能力等级,跑分差距已经不太能反映实际使用上的差异。
- 更便宜:在 Terminal-Bench 这项编程测试里,默认力度就赢过 Opus 5 开到最高的分数,成本大约五分之一(官方图说)。
- 输出更快:生成速度比 Opus 5 快 3 成以上(官方数字)。
- 默认思考力度调低:Claude 回答前会先“想”一下,想得越深通常越准确,但也越慢越贵。这个力度分成好几个等级,Opus 5.5 默认用中等力度(medium),Opus 5 默认用较高的力度(high),需要的话都可以自己手动调高。
- Claude Code 默认换模型:根据 Claude Code 的更新记录,用 Pro 或 Team Standard 方案的 Claude Code,默认模型已经从 Sonnet 换成 Opus,不用自己手动选择。
跑分怎么看

跑分是什么?简单说,就是拿同一组任务让不同模型做,再按表现打分,分数越高代表那项工作做得越好。
官方公布的九项测试里,Opus 5.5 在七项拿下表中最高分(其中三项 GPT-6 Astra 没有公布分数,GPT 模型的分数由 OpenAI 自行回报),包括让 AI 自己在终端里编程的测试(Terminal-Bench 4.0)拿下 66.4%、知识工作类测试(GDPval-AA v2.1)拿下 1846 分。输掉的两项都是 GPT-6 Astra:自动化商业流程测试(AutomationBench)40.0% 对 41.4%,以及科学研究类测试(Terminal-Bench-Science)58.7% 对 64.6%。Anthropic 自己也提醒,模型能力到了这个等级,跑分的差距已经不太能反映真实使用时的感受。
价格与方案

| 项目 | Opus 5.5 | Opus 5 |
|---|---|---|
| 输入 | $4/MTok | $5/MTok |
| 输出 | $20/MTok | $25/MTok |
| 缓存读取 | $0.20/MTok | $0.50/MTok |
上面这张表的单位是“每百万 token”(MTok)。打个比方,如果一个任务用了 100 万个输入 token,又生成了 100 万个输出 token,用 Opus 5.5 大约要花 24 美元(4 加 20),用 Opus 5 则要花 30 美元(5 加 25)。缓存读取指的是重复使用同一段对话内容时的收费,通常比第一次输入便宜很多,用 Claude Code 跑长任务、经常回头读取同一份数据的人会很有感。
谁能用:如果你是 claude.ai 的 Pro、Max、Team 或 Enterprise 订阅用户,可以直接在模型菜单里选择 Opus 5.5;免费方案目前还不能用(截至 2026 年 9 月)。开发者则可以通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 获取。GitHub 表示,Copilot 的付费用户(Pro+、Max、Business、Enterprise)也能选择使用,正在逐步开放。
要注意的是,上面这张价目表是给开发者通过 API 接入时看的计费方式;如果你是订阅 claude.ai 的 Pro、Max 这类方案,是每月固定收费,不用自己计算 token,只是用量有上限。两种付费方式不一样,别搞混了。
开发者要注意的变更
以下是给正在编程、接入 API 的开发者看的,一般用户可以直接跳过:
- thinking 关不掉:以前可以用参数关闭“思考”,Opus 5.5 不行,强行关闭会直接返回错误。
- 强制指定工具会出错:以前可以强制要求模型一定要调用某个工具,Opus 5.5 这样设置会出错,改用自动判断还是正常。
- thinking blocks 绑定模型:Opus 5.5 读得懂旧版 Opus 留下的思考记录,但读不懂 Fable 留下的,跨模型混用要注意。
- 旧版 computer use 工具失效:在 Claude API 和 Google Cloud 上,操作电脑屏幕用的旧版工具已经停用,要换新版。
安全重点
Anthropic 每次发布新模型都会公布一份几百页的“系统卡”,说明这款模型做过哪些安全测试、有哪些风险。不用整份读完,这次的重点是:
- 对齐测试表现亮眼:系统卡说,Opus 5.5 做出“不对齐”行为(偏离人类期望、可能配合滥用)的比例,是近期 Claude 模型里最低的。
- 粘贴文字的提示注入退步:如果你把一段文字粘贴进对话里,里面藏着恶意指令,Opus 5.5 比以前的模型更容易照做;不过加上官方的防护措施后,基本上不会照做。
- 敏感任务自动切换模型:在 Claude 的 App 里,问到网络安全或生物相关的敏感问题时,系统会自动把对话转给 Opus 4.8 或 Opus 5 回答,画面上会提示已经换模型,不会偷偷发生。
小企鹅的总结
老实说,小企鹅玩了一天 Opus 5.5,有点感动到。它总算回到 Opus 4.6 那种好沟通的感觉,不像 Opus 5 说话跟机器人一样。拿来指挥其他 agent(orchestration)也特别顺,终于可以让它自己 spawn subagents(派出子 agent)分头做事,这点 Opus 4.6 就比较笨拙。token 也用得比较省。最有感的是,回复里那些奇怪的“—”终于不见了 😭
接下来小企鹅会继续测试 Opus 5.5,有新心得再发上来。
受益最直接的是两种人:通过 API 付 Opus 5 价格的人,以及用 Pro 或 Team Standard 方案 Claude Code 的人,后者的默认模型已经换成 Opus。开发者记得重新测试一次 effort 等级,不要直接沿用旧设置,也留意那四个破坏性变更。免费方案的用户目前还用不到 Opus 5.5(截至 2026 年 9 月)。
本文为 AI 模型 API 计费与订阅方案的消费信息,不涉及证券或投资建议。实际定价以 Anthropic 官方最新公告为准,本文信息截至 2026 年 9 月 23 日,可能已经过时。
延伸阅读
参考资料
封面图片来源:Anthropic(anthropic.com/claude-opus-5-5)
- Anthropic 官方公告:https://www.anthropic.com/claude-opus-5-5
- Claude Opus 5.5 System Card:https://www.anthropic.com/claude-opus-5-5-system-card
- Model overview:https://platform.claude.com/docs/en/models/opus-5-5/overview
- API pricing:https://platform.claude.com/docs/en/about-claude/pricing
- Plans pricing:https://claude.com/pricing
- GitHub Changelog:https://github.blog/changelog/2026-09-22-claude-opus-5-5-is-now-available-in-github-copilot/
- Claude Code CHANGELOG:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md