Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的旗舰模型,也是全新 Claude 5.5 家族的第一个成员。官方称它在多数工作上达到 Claude Fable 5.1 的水平,而运行成本比 Claude Opus 5 低 40%。API id 为 claude-opus-5-5。它保留 1M token 上下文、128K 最大输出和自适应思考,发布当天就成为 Claude 付费套餐的默认模型。
同日发布的 OpenAI 对手是 GPT-6 Sol。
核心功能
- 用 Opus 的价格买到 Fable 级结果:输入每 1M token $4、输出 $20,比 Opus 5 低 20%。缓存读取降到 $0.20,便宜 60%,这在长 agent 与编程会话里最划算。
- 典型负载成本降 40%:这笔节省同时来自更低的标价和每任务更少的 token 消耗,官方还称输出速度比 Opus 5 快 30% 以上。
- 自适应思考,默认 medium:思考常开且自适应,默认强度是
medium。官方建议只有当自己的评测仍不达标时再往上调。 - Anthropic 行为审计最高分:官方称 Opus 5.5 是其自动化行为审计中表现最强的模型,更不容易采取难以撤回的动作,也比 Opus 5 更抗提示注入。
- 首日进入 Copilot:GitHub 支持模型表中 Claude Opus 5.5 已标为 GA,与 Claude Fable 5.1、Claude Opus 5 并列。
模型规格
| 规格 | Claude Opus 5.5 |
|---|---|
| API 模型 | claude-opus-5-5 |
| 上下文 | 1,000,000 token |
| 最大输出 | 128,000 token |
| 知识截止 | 2026-06 |
| 思考 | 自适应(常开) |
| 默认强度 | medium |
| 模态 | 文本+图片输入,文本输出 |
定价
来自 Claude 模型总览,每 1M token:
| 项目 | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| 输入 | $4.00 | $5.00 |
| 输出 | $20.00 | $25.00 |
| 缓存读取 | $0.20 | $0.50 |
| 缓存写入 | $5.00 | $6.25 |
Claude Code 与 Claude Platform 的 Fast mode 最高提速 2.5 倍,价格为每 1M 输入 $8、输出 $40。官方同时上调了 Pro / Max / Team 以及按席位计费的 Enterprise 的 5 小时用量上限,并给订阅用户一次可自行择时使用的额度重置。
基准成绩
官方对比,除特别注明外 Opus 5.5 均按 max 强度运行:
| 基准 | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% |
| FrontierCode v1.1 (Main) | 54.4% | 50.3% | 48.0% | 53.3% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | 未列出 |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 |
| Humanity's Last Exam(带工具) | 67.7% | 65.6% | 63.6% | 57.2% |
| OSWorld 2.0(partial) | 81.8% | 80.7% | 74.0% | 未列出 |
| Chartography(带工具) | 89.0% | 88.4% | 83.4% | 未列出 |
AutomationBench 的 40.0% 由 Zapier 执行,官方注明其中安全干预被记为失败,因此这个数字低估了实际表现。这些都属于厂商或合作方评测,不是独立审计。
适用场景
- 全库级迁移:官方引用早期测试者一天内完成 68 万行代码迁移;另有测试者在三小时内审计并修完 20 万行代码库,而 Opus 5 用了 20 多小时、2.5 倍 token。
- 长周期智能体:1M 上下文加上更便宜的缓存读取,针对 Claude Code 里数小时的会话。
- 知识工作:官方给出的 GDPval-AA v2.1 为 1846,高于 Fable 5.1 与其表格中列出的 GPT-6 模型。
- 受监管场景:Opus 5.5 采用与 Fable 5.1 同级的防护;生命科学验证计划当天开放申请,网络安全验证计划将在未来数周扩大。
限制:Anthropic 自己提醒,在这个能力层级上基准差距已不是现实差异的可靠指标,它与 Fable 5.1 的实际差距比分数显示的更小。另外为符合欧盟 AI 法案,输出带不可见水印;官方自己的事实性测试仍有 18 题里 2 题不合格。
快速开始
- 在 Claude API 里把
model设为claude-opus-5-5,或在 Claude Code 中直接选择。 - 先停在默认的
medium强度,再拿自己的评测对比xhigh与max,确认值得为更多思考付费。 - 从 Opus 5 迁移过来时,预期是单任务成本下降,而不是质量下降。
- 用 prompt caching。缓存读取每 1M token $0.20,agent 会话收益最大。
常见问题
和 Claude Fable 5.1 有什么区别?
官方把 Opus 5.5 定位为多数工作上与 Fable 5.1 同级且成本低得多,只有当 Opus 5.5 拉到更高强度仍不达标时,才建议改用 Fable 5.1。
Claude Sonnet 5.5 出了吗?
还没有。官方称 Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来数周推出,并带有许多相同改进。
GitHub Copilot 里能用吗?
可以。GitHub 的支持模型表中 Claude Opus 5.5 已标为 GA,发布当天即进入 Copilot。
替代方案
- Claude Fable 5.1:Anthropic 面向最苛刻推理的型号。
- Claude Opus 5:上一代 Opus 旗舰,仍以 $5/$25 提供。
- GPT-6 Sol:OpenAI 同日发布,定价 $2/$10。
使用技巧
- 按单任务成本做预算,而不是按单价。官方说的 40% 节省是「更低价格 + 每任务更少 token」的合计。
- 切 Fable 5.1 前先做自己的评测。官方把 Opus 5.5 定位为多数负载的默认起点。
- 留意防护路径。触发网安或生物防护的任务可能改由 Opus 4.8 或 Opus 5 完成,这同时改变成本和答案。
总结
Claude Opus 5.5 是 Anthropic 新的默认前沿模型:多数工作上达到 Fable 5.1 水平,1M 上下文、自适应思考,$4/$20 的定价在 token 上比 Opus 5 低 20%、在典型负载上低 40%。读官方公告与模型总览,再用自己的任务把它和 GPT-6 Sol 对比一遍。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察
GPT-6 Astra 没追上 Fable 5.1,追上的是账单
Artificial Analysis 智能指数上 Fable 5.1 66 分、Astra 61 分,Astra 没追上智力。但完成同一批任务的成本只要 Fable 5.1 的不到一半,真正收紧的是账单,不是脑子。

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
Claude Skills 完全指南 - 十大必备 Skills 详解
深入解析 Claude Skills 扩展机制,详细介绍十大核心技能及 Obsidian 集成,帮助你打造高效的 AI 工作流