GPT-6 Luna は OpenAI で最も効率的な GPT-6 モデルで、2026 年 9 月 22 日に GPT-6 Sol と同時に発表され、ファミリー内では Sol の下に位置します。API id は gpt-6-luna。OpenAI は GPT-5.6 Luna のプロモ価格から半額にし、入力 100 万トークン $0.10、出力 $0.50、キャッシュ入力は $0.01 としました。コンテキストは 1,050,000 トークンを維持し、推論強度は none から max まで対応します。
前世代の低価格 tier は GPT-5.6 Luna、中間 tier は GPT-5.6 Terra です。
主な機能
- GPT-6 で最安の一枠:$0.10/$0.50、キャッシュ入力 $0.01。バッチ分類、ルーティング、長いエージェントループ向けの tier です。
- GPT-6 と同じコンテキスト:1,050,000 トークン、最大入力 922,000、最大出力 128,000。Sol と Astra と同じ枠です。
noneを含む推論強度:none/low/medium(既定)/high/xhigh/max。Chat Completions で関数呼び出しを使うならnoneのままにする必要があります。- Free tier でも利用可:OpenAI は Free と Go のユーザーがデスクトップアプリで GPT-6 Luna を使えると説明しています。有料プランは ChatGPT Work と Codex で Sol と Luna を利用できます。
- Copilot にも搭載:GitHub のサポートモデル表に GPT-6 Luna が GA として載り、GPT-6 Sol と GPT-6 Astra が並びます。
モデル仕様
| 仕様 | GPT-6 Luna |
|---|---|
| API モデル | gpt-6-luna |
| コンテキスト | 1,050,000 トークン |
| 最大入力 | 922,000 トークン |
| 最大出力 | 128,000 トークン |
| 知識カットオフ | 2026-05-18 |
| 推論強度 | none, low, medium, high, xhigh, max |
| モダリティ | テキスト+画像入力、テキスト出力 |
料金
OpenAI の GPT-6 Luna モデルページ の Standard テキスト料金:
| 項目 | 100 万トークンあたり |
|---|---|
| 入力 | $0.10 |
| キャッシュ読み取り | $0.01 |
| キャッシュ書き込み | $0.125 |
| 出力 | $0.50 |
272K の追加課金も同じです。入力が 272K トークンを超えると、リクエスト全体が入力・キャッシュ 2 倍、出力 1.5 倍になります。Batch と Flex は Standard の 50%、Fast mode は 2 倍。
使用シナリオ
- 大量の分類とルーティング:OpenAI は Luna を高速 tier の下に置いています。入力 $0.10 ならファンアウト型の呼び出しも安く回せます。
- コスト上限つきのコーディング:OpenAI の発表では DeepSWE v1.1 で max 強度の GPT-6 Luna が 66.6%。Claude Opus 5 と Fable 5 の medium 強度と同程度で、タスク単価は Opus 5 より約 93% 安いとされています。
- 予算内の業務自動化:AutomationBench で GPT-6 Luna(high)は前世代から 5.4 ポイント改善し、タスク単価は 58% 低いと OpenAI は説明しています。
- 低価格帯のコンピュータ操作:OSWorld 2.0 オフラインで、GPT-6 Luna(max)は GPT-5.6 Sol(medium)を上回り、コストは約 10 分の 1 とされています。
制約:効率はスコアではなくタスク単価に出ます。Artificial Analysis の知能指数は GPT-6 Luna が 37.3 で、Sol、Astra、現在の Claude フロンティアより下です。深い推論が必要なタスクでは、正解を得るためにトークンを多く使うと節約分が消えます。
はじめかた
- Responses API で
modelをgpt-6-lunaにします。 - まずは既定の
medium。純粋な抽出処理ならlowやnoneに下げます。 - 共有プレフィックスをキャッシュします。キャッシュ入力は 100 万トークン $0.01 で、新規入力より 10 倍安いです。
- 272K の倍率を受け入れない限り、長いプロンプトは入力 272K トークン以内に収めます。
よくある質問
GPT-6 Luna と GPT-6 Sol の違いは?
どちらも 1.05M コンテキストと none から max の強度を持ちます。Luna は入力単価が 20 分の 1 でスループットと遅延向け、Sol は難易度の高いコーディングとエージェント作業向けです。価格はそれぞれ $0.10/$0.50 と $2/$10 です。
無料で使える?
製品として無料ではありませんが、OpenAI は Free と Go のユーザーが ChatGPT デスクトップアプリで GPT-6 Luna を利用できると述べています。有料プランなしで広く使える最初の GPT-6 モデルです。
GPT-5.6 Luna から移行すべき?
コスト重視で大量処理が中心なら移行が合理的です。同じコンテキストで定価は 50% 低い。ただし先に自前の評価で精度を測り直してください。
代替案
- GPT-6 Sol:Luna のスコアでは足りないときの一段上。
- GPT-6 Astra:最も難しいタスク向けの OpenAI フラッグシップ。
- GPT-5.6 Luna:前世代の低価格 tier。
ヒント
- 難易度でルーティングしましょう。軽いトラフィックは
none/low、xhighとmaxは少数の難しいリクエストに残します。 - キャッシュ書き込みの価格に注意。100 万トークン $0.125 は安いものの、通常の入力トークンより 25% 高いので、本当に再利用するプレフィックスだけをキャッシュします。
- 「安いモデルは劣る」と決めつけないこと。OpenAI の複数のベンチマークで、Luna の max 強度は前世代 Sol の medium 強度を上回ります。
まとめ
GPT-6 Luna は OpenAI の量産モデルです。1.05M コンテキスト、max までの推論強度、そして GPT-6 全ラインナップで最も安い $0.10/$0.50 の価格を持ちます。公式発表と API モデルページを読み、この tier を超える必要があるトラフィックだけを GPT-6 Sol に流してください。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。

Anthropic Subagent: マルチエージェント時代のアーキテクチャ革命
Anthropicのマルチエージェントアーキテクチャ設計を徹底解説。Subagentによるコンテキストウィンドウ制限の突破、90%のパフォーマンス向上、Claude Codeでの実際の応用について学びます。
AI アシスタントをチャットボックスに押し込むな:Clawdbot は戦場を間違えた
Clawdbot は便利だが、Slack や Discord に入れて操作するのは最初から間違った設計だ。チャットツールはタスク操作のためのものではなく、AI もおしゃべりのためではない。