Claude Opus 5.5 logo

Claude Opus 5.5

打开

Anthropic Claude Opus 5.5:Fable 5.1 级智能,每 1M token $4/$20,1M 上下文,首日进入 GitHub Copilot。

分享:
查看替代方案

Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的旗舰模型,也是全新 Claude 5.5 家族的第一个成员。官方称它在多数工作上达到 Claude Fable 5.1 的水平,而运行成本比 Claude Opus 5 低 40%。API id 为 claude-opus-5-5。它保留 1M token 上下文、128K 最大输出和自适应思考,发布当天就成为 Claude 付费套餐的默认模型。

同日发布的 OpenAI 对手是 GPT-6 Sol

核心功能

  • 用 Opus 的价格买到 Fable 级结果:输入每 1M token $4、输出 $20,比 Opus 5 低 20%。缓存读取降到 $0.20,便宜 60%,这在长 agent 与编程会话里最划算。
  • 典型负载成本降 40%:这笔节省同时来自更低的标价和每任务更少的 token 消耗,官方还称输出速度比 Opus 5 快 30% 以上。
  • 自适应思考,默认 medium:思考常开且自适应,默认强度是 medium。官方建议只有当自己的评测仍不达标时再往上调。
  • Anthropic 行为审计最高分:官方称 Opus 5.5 是其自动化行为审计中表现最强的模型,更不容易采取难以撤回的动作,也比 Opus 5 更抗提示注入。
  • 首日进入 Copilot:GitHub 支持模型表中 Claude Opus 5.5 已标为 GA,与 Claude Fable 5.1、Claude Opus 5 并列。

模型规格

规格 Claude Opus 5.5
API 模型 claude-opus-5-5
上下文 1,000,000 token
最大输出 128,000 token
知识截止 2026-06
思考 自适应(常开)
默认强度 medium
模态 文本+图片输入,文本输出

定价

来自 Claude 模型总览,每 1M token:

项目 Claude Opus 5.5 Claude Opus 5
输入 $4.00 $5.00
输出 $20.00 $25.00
缓存读取 $0.20 $0.50
缓存写入 $5.00 $6.25

Claude Code 与 Claude Platform 的 Fast mode 最高提速 2.5 倍,价格为每 1M 输入 $8、输出 $40。官方同时上调了 Pro / Max / Team 以及按席位计费的 Enterprise 的 5 小时用量上限,并给订阅用户一次可自行择时使用的额度重置。

基准成绩

官方对比,除特别注明外 Opus 5.5 均按 max 强度运行:

基准 Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9%
FrontierCode v1.1 (Main) 54.4% 50.3% 48.0% 53.3%
CursorBench 4.0 57.8% 51.8% 46.6% 未列出
GDPval-AA v2.1 1846 1735 1708 1542
Humanity's Last Exam(带工具) 67.7% 65.6% 63.6% 57.2%
OSWorld 2.0(partial) 81.8% 80.7% 74.0% 未列出
Chartography(带工具) 89.0% 88.4% 83.4% 未列出

AutomationBench 的 40.0% 由 Zapier 执行,官方注明其中安全干预被记为失败,因此这个数字低估了实际表现。这些都属于厂商或合作方评测,不是独立审计。

适用场景

  • 全库级迁移:官方引用早期测试者一天内完成 68 万行代码迁移;另有测试者在三小时内审计并修完 20 万行代码库,而 Opus 5 用了 20 多小时、2.5 倍 token。
  • 长周期智能体:1M 上下文加上更便宜的缓存读取,针对 Claude Code 里数小时的会话。
  • 知识工作:官方给出的 GDPval-AA v2.1 为 1846,高于 Fable 5.1 与其表格中列出的 GPT-6 模型。
  • 受监管场景:Opus 5.5 采用与 Fable 5.1 同级的防护;生命科学验证计划当天开放申请,网络安全验证计划将在未来数周扩大。

限制:Anthropic 自己提醒,在这个能力层级上基准差距已不是现实差异的可靠指标,它与 Fable 5.1 的实际差距比分数显示的更小。另外为符合欧盟 AI 法案,输出带不可见水印;官方自己的事实性测试仍有 18 题里 2 题不合格。

快速开始

  1. 在 Claude API 里把 model 设为 claude-opus-5-5,或在 Claude Code 中直接选择。
  2. 先停在默认的 medium 强度,再拿自己的评测对比 xhighmax,确认值得为更多思考付费。
  3. 从 Opus 5 迁移过来时,预期是单任务成本下降,而不是质量下降。
  4. 用 prompt caching。缓存读取每 1M token $0.20,agent 会话收益最大。

常见问题

和 Claude Fable 5.1 有什么区别?

官方把 Opus 5.5 定位为多数工作上与 Fable 5.1 同级且成本低得多,只有当 Opus 5.5 拉到更高强度仍不达标时,才建议改用 Fable 5.1。

Claude Sonnet 5.5 出了吗?

还没有。官方称 Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来数周推出,并带有许多相同改进。

GitHub Copilot 里能用吗?

可以。GitHub 的支持模型表中 Claude Opus 5.5 已标为 GA,发布当天即进入 Copilot。

替代方案

使用技巧

  1. 按单任务成本做预算,而不是按单价。官方说的 40% 节省是「更低价格 + 每任务更少 token」的合计。
  2. 切 Fable 5.1 前先做自己的评测。官方把 Opus 5.5 定位为多数负载的默认起点。
  3. 留意防护路径。触发网安或生物防护的任务可能改由 Opus 4.8 或 Opus 5 完成,这同时改变成本和答案。

总结

Claude Opus 5.5 是 Anthropic 新的默认前沿模型:多数工作上达到 Fable 5.1 水平,1M 上下文、自适应思考,$4/$20 的定价在 token 上比 Opus 5 低 20%、在典型负载上低 40%。读官方公告模型总览,再用自己的任务把它和 GPT-6 Sol 对比一遍。

评论

还没有评论。成为第一个评论的人!