Claude Opus 4.6
Claude Opus 4.6 是 Anthropic 于 2026 年 2 月 5 日发布的前沿旗舰模型。它是一个混合推理模型:既可以快速作答,也可以进入深度思考;启用自适应思考后,模型会自行判断何时值得投入更深的推理,开发者通过四个强度档位(low、medium、high、max)进行调节。Opus 4.6 还是首款支持 100 万 token 上下文窗口(测试版)的 Opus 级模型,Anthropic 称这标志着模型在保持巅峰性能的同时能够真正用足长上下文的质的转变。
核心功能
- 混合推理 + 自适应思考:通过四个强度档位在智能、速度与成本之间取舍,模型自动决定推理深度。
- 100 万 token 上下文(测试版):在 Claude Developer Platform 提供,最高 128k 输出 token,超过 200k token 的提示词使用更高定价档。
- 对抗「上下文腐化」:在 MRCR v2 的 8 针 100 万变体上得分 76%,而 Sonnet 4.5 仅为 18.5%,意味着它能在极长的对话中准确检索被「藏起来」的信息而不掉链子。
- 长程自主性:规划更缜密、在任务上坚持更久,减少复杂多步骤工作流中的人工来回确认。
- 广泛的平台可用性:claude.ai、Claude API(模型 ID
claude-opus-4-6)以及 AWS、Google Cloud、Microsoft Foundry 等主流云平台。
性能亮点
- Terminal-Bench 2.0:在前沿模型的智能体编码评测中得分最高
- SWE-bench Verified:81.42%(修改提示词,25 次采样平均)
- Humanity's Last Exam(带工具):53.0%,领先所有其他前沿模型
- BrowseComp:83.7%(使用多智能体框架时 86.8%)
- MCP Atlas:high 强度下 62.7%,行业领先
- GDPval-AA:比 OpenAI 的 GPT-5.2 高出约 144 Elo 分
定价
| 方案 | 每百万 token 价格 | 功能 |
|---|---|---|
| 标准 | 输入 $5 / 输出 $25 | 标准上下文(最高 200k token) |
| 长上下文 | 输入 $10 / 输出 $37.50 | 超过 200k token、最高 100 万 |
适用场景
- 智能体编码:在 Terminal-Bench 2.0 与 SWE-bench Verified 上均为行业顶级,是自主软件工程的有力默认选择。
- 企业知识工作:在覆盖金融、法律等领域的 GDPval-AA 上领先,是 Harvey 等律所工作流(BigLaw Bench 90.2%)的热门选择。
- 长上下文分析:MRCR v2 的成绩使其能够单次处理大型代码库、法律文档与研究语料。
- 计算机使用与工具调用:在计算机使用、网络搜索、程序化工具调用等评测中表现优异。
快速开始
- 在 claude.ai 上直接使用,或通过 Claude API 与 Claude Code 中的 SDK 接入。
- API 中使用模型标识
claude-opus-4-6。 - 通过强度档位(low/medium/high/max)设置思考预算,或开启自适应思考让模型自行决定。
- 上下文超过 200k token 时,注意使用更高的长上下文定价档。
优势对比
Opus 4.6 直接回应了行业中「上下文腐化」这一痛点——对话一长,其他模型的性能就开始衰减。自适应思考、智能体编码领先和 100 万 token 上下文三者的组合,使其非常适合运行长程自主工作流的团队。与前任 Opus 4.5 相比,它在 GDPval-AA 上提升了约 190 Elo 分,长上下文检索能力更是质的飞跃。
常见问题
Opus 4.6 与 Opus 5 有什么区别?
Opus 5 是之后发布的 Anthropic 最新旗舰;Opus 4.6 仍可使用,部分用户更偏好它在长智能体会话中更连贯的日常语言表达与稳定表现。
Opus 4.6 开源吗?
不开源。仅通过 Anthropic 应用、API 与云合作伙伴提供。
支持多模态输入吗?
支持。Opus 4.6 接受文本与视觉输入。
替代方案
- GPT-5.6:OpenAI 的前沿推理系列:/zh/items/models/gpt-5.6
- Gemini 3 Pro:Google 的前沿模型:/zh/items/models/google-gemini-3-pro
- GLM-5.3:智谱的开源权重编码与智能体旗舰模型:/zh/items/models/glm-5-3
总结
对于运行长程智能体编码或企业知识工作的团队而言,Claude Opus 4.6 是一次实打实的升级。自适应思考、Terminal-Bench 与 GDPval-AA 的行业领先成绩,加上 Opus 级首个 100 万 token 上下文窗口,使其成为需要长时间维持巅峰性能的自主工作流的顶级默认选择。
使用条款
使用须遵守 Anthropic 的 商业服务条款。
评论
还没有评论。成为第一个评论的人!
相关工具
Claude Opus 5
www.anthropic.com/claude/opus
Anthropic 前沿 Opus 级模型,1M token 上下文与可调思考强度,以 Opus 4.8 的价格带来接近 Fable 5 的智能水平,适合智能体与长周期编码任务。
Claude Opus 4.5
www.anthropic.com
Anthropic 最智能的模型,结合最大能力与实用性能,具有独特的 effort 参数控制和卓越的长期编程效率。
Claude Fable 5
www.anthropic.com/claude/fable
Anthropic 首个向公众开放的 Mythos 级旗舰模型:1M token 上下文、前沿编程与视觉能力、长达数天的智能体自主工作,输入 $10 / 输出 $50 每 1M token。
相关洞察

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
Claude Skills 完全指南 - 十大必备 Skills 详解
深入解析 Claude Skills 扩展机制,详细介绍十大核心技能及 Obsidian 集成,帮助你打造高效的 AI 工作流
低代码平台的黄昏:为什么 Claude Agent SDK 会让 Dify 们成为历史
从大模型第一性原理深度剖析为什么 Claude Agent SDK 将取代 Dify。探讨为什么自然语言描述流程比图形化编排更符合人类原始行为模式,以及为什么这是 AI 时代的必然选择。