Claude Opus 4.6 logo

Claude Opus 4.6

打开

Anthropic 最强混合推理模型:100 万 token 上下文、自适应思考,在智能体编码与专业知识工作上位居行业前列。

分享:

Claude Opus 4.6

Claude Opus 4.6 是 Anthropic 于 2026 年 2 月 5 日发布的前沿旗舰模型。它是一个混合推理模型:既可以快速作答,也可以进入深度思考;启用自适应思考后,模型会自行判断何时值得投入更深的推理,开发者通过四个强度档位(low、medium、high、max)进行调节。Opus 4.6 还是首款支持 100 万 token 上下文窗口(测试版)的 Opus 级模型,Anthropic 称这标志着模型在保持巅峰性能的同时能够真正用足长上下文的质的转变。

核心功能

  • 混合推理 + 自适应思考:通过四个强度档位在智能、速度与成本之间取舍,模型自动决定推理深度。
  • 100 万 token 上下文(测试版):在 Claude Developer Platform 提供,最高 128k 输出 token,超过 200k token 的提示词使用更高定价档。
  • 对抗「上下文腐化」:在 MRCR v2 的 8 针 100 万变体上得分 76%,而 Sonnet 4.5 仅为 18.5%,意味着它能在极长的对话中准确检索被「藏起来」的信息而不掉链子。
  • 长程自主性:规划更缜密、在任务上坚持更久,减少复杂多步骤工作流中的人工来回确认。
  • 广泛的平台可用性:claude.ai、Claude API(模型 ID claude-opus-4-6)以及 AWS、Google Cloud、Microsoft Foundry 等主流云平台。

性能亮点

  • Terminal-Bench 2.0:在前沿模型的智能体编码评测中得分最高
  • SWE-bench Verified:81.42%(修改提示词,25 次采样平均)
  • Humanity's Last Exam(带工具):53.0%,领先所有其他前沿模型
  • BrowseComp:83.7%(使用多智能体框架时 86.8%)
  • MCP Atlas:high 强度下 62.7%,行业领先
  • GDPval-AA:比 OpenAI 的 GPT-5.2 高出约 144 Elo 分

定价

方案 每百万 token 价格 功能
标准 输入 $5 / 输出 $25 标准上下文(最高 200k token)
长上下文 输入 $10 / 输出 $37.50 超过 200k token、最高 100 万

适用场景

  • 智能体编码:在 Terminal-Bench 2.0 与 SWE-bench Verified 上均为行业顶级,是自主软件工程的有力默认选择。
  • 企业知识工作:在覆盖金融、法律等领域的 GDPval-AA 上领先,是 Harvey 等律所工作流(BigLaw Bench 90.2%)的热门选择。
  • 长上下文分析:MRCR v2 的成绩使其能够单次处理大型代码库、法律文档与研究语料。
  • 计算机使用与工具调用:在计算机使用、网络搜索、程序化工具调用等评测中表现优异。

快速开始

  1. 在 claude.ai 上直接使用,或通过 Claude API 与 Claude Code 中的 SDK 接入。
  2. API 中使用模型标识 claude-opus-4-6
  3. 通过强度档位(low/medium/high/max)设置思考预算,或开启自适应思考让模型自行决定。
  4. 上下文超过 200k token 时,注意使用更高的长上下文定价档。

优势对比

Opus 4.6 直接回应了行业中「上下文腐化」这一痛点——对话一长,其他模型的性能就开始衰减。自适应思考、智能体编码领先和 100 万 token 上下文三者的组合,使其非常适合运行长程自主工作流的团队。与前任 Opus 4.5 相比,它在 GDPval-AA 上提升了约 190 Elo 分,长上下文检索能力更是质的飞跃。

常见问题

Opus 4.6 与 Opus 5 有什么区别?

Opus 5 是之后发布的 Anthropic 最新旗舰;Opus 4.6 仍可使用,部分用户更偏好它在长智能体会话中更连贯的日常语言表达与稳定表现。

Opus 4.6 开源吗?

不开源。仅通过 Anthropic 应用、API 与云合作伙伴提供。

支持多模态输入吗?

支持。Opus 4.6 接受文本与视觉输入。

替代方案

总结

对于运行长程智能体编码或企业知识工作的团队而言,Claude Opus 4.6 是一次实打实的升级。自适应思考、Terminal-Bench 与 GDPval-AA 的行业领先成绩,加上 Opus 级首个 100 万 token 上下文窗口,使其成为需要长时间维持巅峰性能的自主工作流的顶级默认选择。

使用条款

使用须遵守 Anthropic 的 商业服务条款

评论

还没有评论。成为第一个评论的人!