Generate Image Skill logo

Generate Image Skill

開く

OpenRouter Image API を使った画像生成・編集スキル。1 本のスクリプトで Gemini、FLUX、Seedream、Recraft、GPT-Image など多数のモデルを呼び出せます。

共有:
代替ツールを見る

画像生成

Generate Image は、K-Dense のオープンソース Claude Scientific Writer(MIT)に含まれるスキルで、写真、イラスト、コンセプトアート、ロゴの生成と画像編集を行います。現行のバージョン 2.0(2026-07-26 レビュー)は OpenRouter Image API(POST /api/v1/images)を対象とし、Gemini、FLUX、Seedream、Recraft、GPT-Image など約 30 以上のモデルを同じリクエスト形式で呼び出します。以前の紹介では FLUX.2 Pro と Gemini 3 Pro しか挙げられていませんでした。

主な機能

  • 1 本のスクリプトで多数のモデル:scripts/generate_image.py の既定は google/gemini-3.1-flash-image です。スキルのモデル表では、Gemini の最上位に google/gemini-3-pro-image、写実的な制御とシード固定に black-forest-labs/flux.2-pro、安価な試行に flux.2-klein-4b、SVG に recraft/recraft-v4-vector、透過背景に openai/gpt-image-2 を勧めています。
  • パラメータへの配慮:モデルは非対応のパラメータを拒否するため、スクリプトは指定されたフラグだけを送ります。たとえば --resolution は Gemini では使えても FLUX では使えず、--seed は FLUX では使えても Gemini と OpenAI では使えません。--list-models は最新の対応状況を表示し、キーは不要です。
  • 編集と参照画像:-i は繰り返し指定でき、ローカルファイル、URL、data URL を編集や合成に使えます。参照画像の上限はモデルにより 1 枚(Recraft)から 16 枚(OpenAI)まで異なります。
  • コストの可視化:呼び出しごとに usage.cost の料金を表示します。課金は全か無かで、失敗した生成は請求されません。

使用シナリオ

  • ポスターやスライドのメインビジュアルと背景。
  • 論文やブログ記事のコンセプトイラスト。
  • ベクターロゴや、ビジュアル案のバリエーションを素早く作る。

料金と入手方法

スキル自体は無料(MIT)で、Python 標準ライブラリ(3.9 以上)だけを使います。生成はすべて OPENROUTER_API_KEY による OpenRouter の有料リクエストで、料金は選んだモデルによって決まります。

はじめに

  1. Claude Code でプラグインを追加:/plugin marketplace add https://github.com/K-Dense-AI/claude-scientific-writer、続けて /plugin install claude-scientific-writer。
  2. 環境変数か、Git 管理外の .env ファイルに OPENROUTER_API_KEY を設定します。
  3. python scripts/generate_image.py "A beautiful sunset over mountains" を実行するか、python scripts/generate_image.py "Make the sky purple" -i photo.jpg -o edited.png で編集します。

制約:参照画像は OpenRouter にアップロードされるため、未発表や機密のデータは送らないでください。非対応のパラメータを送ると無視されず HTTP 400 になります。

よくある質問

フローチャートにも使えますか?

使いません。技術的な図は、品質レビューのループを持つ Scientific Schematics に任せるよう案内しています。

一度に複数枚作れますか?

対応モデルなら --n で可能です。Seedream と OpenAI は最大 10 枚、Recraft は 6 枚、Gemini と FLUX は 1 枚だけです。

代替案

  • Nano Banana:スクリプトなしで直接使える Google の画像モデル。
  • GPT Image 2:このスキル経由でも呼び出せる OpenAI の画像モデル。
  • Canvas Design Skill:単純な生成ではなく、デザインされたビジュアル作品向けの Anthropic のスキル。

まとめ

Generate Image は、OpenRouter 上のほぼすべての画像モデルを Claude が 1 つのコマンドで呼び出せる、薄くてドキュメントの整ったラッパーです。試行段階では安いモデルを選び、機密性のある参照画像はローカルに留めましょう。詳しくは スキル一覧 へ。

コメント

まだコメントがありません。最初のコメントを投稿してください!