Prime Agent logo

Prime Agent

開く

PrimeIntellect の自己改善型コーディングエージェント。Recursive Language Model(RLM)を基盤とし、唯一のツールとして永続 IPython カーネルを採用。/refine コマンドでエージェント自身を改善し、範囲を限定した自律モードを搭載。

共有:

Prime Agent は、Recursive Language Model(RLM)上に構築された PrimeIntellect のオープンソースコーディングエージェントです。RLM とは、エージェントがコンテキストを変数として、サブエージェントを永続 REPL 内の関数呼び出しとして扱う研究方向です。2026年8月5日にリリースされ、最も知られているのが /refine コマンド。エージェントが自身の実行軌跡を読み取り、自身のプロンプト、Skills、メモリを改善するための CRUD 編集を適用します。最初の数か月で GitHub スターは15,000を超え、自分で運用できる自己改善型エージェントの代表的な存在となっています。

主な機能

  • Recursive Language Model:永続 IPython カーネル内で、コンテキストは変数、サブエージェントは関数呼び出し。エージェント全体がプログラマブルな Python です。
  • /refine による自己改善:エージェントが自身の軌跡を読み取り、自身の設定、Skills、メモリに対して証拠に基づく更新を行います。
  • 唯一のツールとしての永続カーネル:数十の専用ツールではなく、すべての操作が1つの IPython カーネルを通ります。
  • デーモンバックのセッション:ターミナルを切断してもエージェントは動き続け、いつでも再接続できます。
  • エージェント間メッセージング:実行中のセッション同士が直接会話できます。
  • 実行可能な Skills:Skills はプロンプトテキストではなく、型付き呼び出し可能なインポート可能な Python パッケージです。
  • 範囲限定の自律モード:永続ゴール、ハートビート、スケジュール、トークン予算により、自律実行を制御下に保ちます。
  • 長時間の eval サポート:品質ゲートを備え、数時間から数日の運用を想定した設計です。

ユースケース

このツールを使用すべき人は?

  • Python 開発者:エージェント全体が Python。状態、ツール、Skills はすべてプログラマブルで内部を検査できます。
  • 研究者:RLM は活発な研究領域であり、これは実際に動かせるリファレンス実装です。
  • 自律タスクの実行者:デーモンセッションと範囲限定の自律性は、長時間の無人ジョブに適しています。

解決する問題

  1. 静的なエージェント:ほとんどのエージェントは動作を変えませんが、Prime Agent の /refine はそのループを閉じます。
  2. ツールの乱立:永続カーネルが、壊れやすい数十のツールを型付きの1つの実行面に置き換えます。
  3. セッション喪失:デーモンバックのセッションは、ターミナル切断を生き延びます。

料金プラン

項目 コスト 機能
ソフトウェア ¥0(MITライセンス) フルエージェント、セルフホスト、利用制限なし
モデル 自身のAPIキーを持ち込み OpenAI、Anthropic、Prime Intellect 推論

Prime Agent は無料のオープンソースです。モデルのAPIキーは自身で持ち込むか、PrimeIntellect 独自の推論サービスをトークン従量制で利用します。

優位性と独自の価値提案

競合他社と比較した優位性

  1. 自己改善:証拠に基づく更新を行う /refine は、主流のコーディングエージェントの中で唯一無二です。
  2. 単一ツール:肥大したツールAPIではなく1つの永続 IPython カーネル。監査と拡張が簡単です。
  3. 研究の系譜:Prime Intellect の公開済み RLM 研究に基づき、ARC-AGI 3 や GPU カーネルベンチマークで競争力のある結果を出しています。

際立つポイント

  • エージェント自身のプロンプト、Skills、メモリが、編集可能な第一級オブジェクトです。
  • エージェント間メッセージングにより、新しいマルチエージェントのトポロジーが可能になります。
  • 予算付きの範囲限定自律モードにより、長時間の無人実行が安全です。

ユーザーレビュー

r/LocalLLaMA や r/ChatGPTCoding でのコミュニティの議論は、自己改善という新規性に集中しています。失敗の後にエージェントが自身の Skills を編集する様子が、最も共有されるデモです。レビュアーはまた、カーネルベースの設計により、すべてのアクションが読める Python である点を、異例の透明性として評価しています。主な批判は、Python 中心のワークフローを最初の対象としている点で、他言語のサポートはまだ成熟途中です。

はじめに

クイックスタートガイド

  1. インストールpip install prime-agent
  2. 設定:モデルのAPIキー(OpenAI、Anthropic、Prime 推論)を追加します。
  3. タスクを実行:セッションを開始し、コーディングタスクを説明します。
  4. 改善:失敗したら /refine を実行し、自身の Skills とメモリを更新する様子を見守ります。

連携

  • モデル:OpenAI、Anthropic、Prime Intellect 推論。
  • ランタイム:Python 3.12+ が動く任意のマシン。ヘッドレス運用にはデーモンモード。

よくある質問

Prime Agent は無料ですか?

はい。MIT ライセンスで、費用がかかるのはモデル推論だけです。

本当に自己改善するのですか?

はい。/refine はエージェント自身の軌跡を読み取り、各変更の証拠とともに、プロンプト、Skills、メモリへ CRUD 編集を適用します。

GPU は必要ですか?

いいえ。リモートのモデルAPIを統括します。ローカル推論はオプションです。

Claude Code と比べてどうですか?

Claude Code は広いツールエコシステムを持つ本番重視のエージェントです。Prime Agent は研究グレードの Python 中心エージェントで、面白さの核心は自己改変にあります。

代替案

Prime Agent が合わない場合、次の選択肢を検討してください:

  • Claude Code:成熟したエコシステムを持つ、Anthropic の本番向けターミナルエージェント。
  • OpenHands:オープンソースの自律コーディングエージェントプラットフォーム。
  • Goose:拡張可能なツールキットを持つ、Block のオープンソースローカルエージェント。

ヒントとベストプラクティス

  1. 失敗のたびに /refine:エージェントの自己改善こそが中核価値です。自分のループの一部に組み込みましょう。
  2. Skills は型付き Python で書く:実行可能で型付きの Skills は、プロンプトのみの Skills よりはるかに信頼できます。
  3. 自律モードでは予算を設定:トークンと時間の予算が、長時間の無人実行を予測可能に保ちます。

まとめ

Prime Agent は、現時点で最も信頼性の高い自己改善型コーディングエージェントです。エージェント自身の設定を編集可能な状態へと変えます。自分のワークフローに合わせて時間とともに賢くなり、その過程を目撃できるエージェントを求める Python 開発者や研究者にとって、これは紛れもなく新しいカテゴリーのツールです。

コメント

まだコメントがありません。最初のコメントを投稿してください!