Claude Opus 5.5 は Anthropic が 2026 年 9 月 22 日に出したフラッグシップで、新しい Claude 5.5 ファミリーの最初のモデルです。Anthropic は「多くの作業で Claude Fable 5.1 と同等の性能を、Claude Opus 5 より 40% 低い実行コストで」と説明しています。API id は claude-opus-5-5。1M トークンのコンテキスト、最大出力 128K、アダプティブ思考を維持し、発売当日から Claude の有料プランの既定モデルになりました。
同日発表の OpenAI 側の対抗馬は GPT-6 Sol です。
主な機能
- Opus の価格で Fable 級の結果:入力 100 万トークン $4、出力 $20 で、Opus 5 より 20% 安い。キャッシュ読み取りは $0.20 で 60% 低下し、長いエージェントやコーディング作業でもっとも効きます。
- 典型的な作業でコスト 40% 減:安い定価と 1 タスクあたりのトークン削減の合計で、出力速度も Opus 5 より 30% 以上速いとされています。
- アダプティブ思考、既定は medium:思考は常時オンでアダプティブ、既定の強度は
medium。自前の評価で不足する場合のみ上げるのが公式の推奨です。 - Anthropic の行動監査で最高スコア:公式によれば Opus 5.5 は自動行動監査でこれまでで最強、取り返しのつきにくい行動を取りにくく、Opus 5 よりプロンプトインジェクションに強いとされます。
- 初日から Copilot 対応:GitHub のサポートモデル表で Claude Opus 5.5 は GA として掲載され、Claude Fable 5.1 と Claude Opus 5 が並びます。
モデル仕様
| 仕様 | Claude Opus 5.5 |
|---|---|
| API モデル | claude-opus-5-5 |
| コンテキスト | 1,000,000 トークン |
| 最大出力 | 128,000 トークン |
| 知識カットオフ | 2026-06 |
| 思考 | アダプティブ(常時オン) |
| 既定の強度 | medium |
| モダリティ | テキスト+画像入力、テキスト出力 |
料金
Claude モデル概要 より、100 万トークンあたり:
| 項目 | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| 入力 | $4.00 | $5.00 |
| 出力 | $20.00 | $25.00 |
| キャッシュ読み取り | $0.20 | $0.50 |
| キャッシュ書き込み | $5.00 | $6.25 |
Claude Code と Claude Platform の Fast mode は最大 2.5 倍速で、入力 100 万トークン $8、出力 $40 です。Anthropic は Pro / Max / Team と席単位の Enterprise の 5 時間利用上限も引き上げ、購読者には任意のタイミングで使えるレート制限リセットを配布しました。
ベンチマーク
公式の比較です。特に断りのない限り Opus 5.5 は max 強度です:
| ベンチマーク | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% |
| FrontierCode v1.1 (Main) | 54.4% | 50.3% | 48.0% | 53.3% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | 記載なし |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 |
| Humanity's Last Exam(ツールあり) | 67.7% | 65.6% | 63.6% | 57.2% |
| OSWorld 2.0(partial) | 81.8% | 80.7% | 74.0% | 記載なし |
| Chartography(ツールあり) | 89.0% | 88.4% | 83.4% | 記載なし |
AutomationBench の 40.0% は Zapier が実行したもので、Anthropic はセーフガードの介入が失敗として扱われたと注記しています。つまり実力より低く出た数字です。いずれもベンダーまたはパートナーによる評価で、独立した監査ではありません。
使用シナリオ
- コードベース全体の移行:公式は、早期テスターが 68 万行の移行を 1 日以内に終えた例や、20 万行のコードベースを 3 時間以内に監査・修正した例を挙げています。Opus 5 では 20 時間以上と 2.5 倍のトークンが必要でした。
- 長時間エージェント:1M コンテキストと安いキャッシュ読み取りは、Claude Code の数時間セッション向けです。
- ナレッジワーク:公式の GDPval-AA v2.1 は 1846 で、Fable 5.1 と表に載る GPT-6 モデルを上回ります。
- 規制産業:Opus 5.5 は Fable 5.1 級のセーフガードで展開され、生命科学検証プログラムは当日から、サイバー検証プログラムは数週間以内に拡大予定です。
制約:Anthropic 自身が、この能力水準ではベンチマーク差が実世界の差の信頼できる指標ではなくなったと注意し、Fable 5.1 との差はスコアが示すより小さいと述べています。EU AI 法対応の不可視ウォーターマークも入り、公式の事実性テストでも 18 問中 2 問が不合格でした。
はじめかた
- Claude API で
modelをclaude-opus-5-5にするか、Claude Code で選択します。 - まず既定の
mediumに留まり、自前の評価でxhighとmaxを比較してから思考量に払うか決めます。 - Opus 5 からの移行では、品質低下ではなくタスク単価の低下を期待してください。
- プロンプトキャッシュを使います。キャッシュ読み取りは 100 万トークン $0.20 で、エージェントセッションの効果が最大です。
よくある質問
Claude Fable 5.1 との違いは?
Anthropic は Opus 5.5 を「多くの作業で Fable 5.1 と同等、コストは大幅に低い」と位置づけ、Opus 5.5 を高強度で試しても不足する場合だけ Fable 5.1 を勧めています。
Claude Sonnet 5.5 は出た?
まだです。Anthropic は Claude Sonnet 5.5 と Claude Haiku 5.5 が数週間以内に登場し、多くの改善を引き継ぐと述べています。
GitHub Copilot で使える?
使えます。GitHub のサポートモデル表に Claude Opus 5.5 が GA として掲載され、発売当日に Copilot へ入りました。
代替案
- Claude Fable 5.1:もっとも要求の厳しい推論向けの Anthropic モデル。
- Claude Opus 5:前世代の Opus フラッグシップ。$5/$25 で継続提供。
- GPT-6 Sol:同日発表の OpenAI モデル。価格は $2/$10。
ヒント
- 予算は単価ではなくタスク単価で見ます。公式の 40% 削減は「安い価格 + タスクあたりのトークン減」の合計です。
- Fable 5.1 に切り替える前に自前の評価を取りましょう。公式は Opus 5.5 を多くの用途の既定の出発点と位置づけています。
- セーフガードの経路に注意。サイバーや生物のセーフガードに触れたタスクは Opus 4.8 や Opus 5 が処理することがあり、コストと回答の両方が変わります。
まとめ
Claude Opus 5.5 は Anthropic の新しい既定フロンティアモデルです。多くの作業で Fable 5.1 級、1M コンテキスト、アダプティブ思考、そしてトークン単価で Opus 5 より 20%、典型的な作業で 40% 安い $4/$20 の価格を持ちます。公式発表とモデル概要を読み、自前のタスクで GPT-6 Sol と比較してください。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト
Claude Skills 完全ガイド - 必須10大 Skills 徹底解説
Claude Skills の拡張メカニズムを深掘りし、10の中核スキルと Obsidian 連携を詳しく解説。高効率な AI ワークフロー構築を支援します

Anthropic Subagent: マルチエージェント時代のアーキテクチャ革命
Anthropicのマルチエージェントアーキテクチャ設計を徹底解説。Subagentによるコンテキストウィンドウ制限の突破、90%のパフォーマンス向上、Claude Codeでの実際の応用について学びます。
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。