Nex-N2.5-Pro は Nex-AGI の Nex-N2.5 エージェント家族の中型 SKU です。Hugging Face カード のライセンスは Apache-2.0、pipeline は text-generation、アーキテクチャは qwen3_5_moe。2026-09-12 の Hugging Face は 595 likes、直近 30 日 12,260 ダウンロード。createdAt は 2026-09-08。API の safetensors 合計は約 396.8B パラメータ。r/LocalLLaMA のホット投稿見出しは「Nex N2.5 Pro (407GB) released」。407GB はコミュニティのラベルであり、一次のバイト数ではありません。
家族には mini と Max もあります。Max は 1.6T のテキスト専用 MoE と書かれます。このページは Pro チェックポイントであり、Max でも Nex-N2.5-mini でもありません。
対照は Nex-N2.5-mini(35B レシピ)、Qwen3.8-Flash-Next(Alibaba の疎なオープン MoE)、GLM-5.3-Flash(安価なホスト高速 SKU)。
主な機能
- エージェント型マルチモーダル:カードは mini と Pro が Nex-N2 のコンピュータ操作、閲覧、視覚接地エージェント経路を継ぐと書きます。視覚は入力だけでなく、結果を確かめるインタフェースとして枠付けされます。
- 思考モード:
reasoning_effortは"none"、"medium"(デフォルトの適応)、"high"。チャットテンプレートはこのフィールドを使い、汎用のenable_thinkingではありません。 - サーブ:カスタム SGLang イメージ
nexagi/sglang:v0.5.18-nex-patch。Pro レシピは単一ノード 8 x H100、--tp 8、--reasoning-parser qwen3、--tool-call-parser qwen3_coder。 - カードのサンプリング:
temperature0.7、top_p0.95、top_k40。 - ホスト経路:2026-09-12 の OpenRouter は
nex-agi/nex-n2.5-pro:freeを $0 / $0、コンテキスト 262,144 と列挙。無料席を約束する前に slug を再確認。
限界:GitHub ミラー nex-agi/Nex-N2.5 は 2026-09-12 時点で 96 stars。カードのベンチ表は一次情報で、NexAU / NexCUA ハーネスが多いです。再実行していません。595 likes は熱量であり監査ではありません。
仕様
| 項目 | 値 | 出典 |
|---|---|---|
| パラメータ(safetensors) | 約 396.8B | HF API、2026-09-12 |
| ライセンス | Apache-2.0 | HF カード |
| Likes / 直近 30 日 DL | 595 / 12,260 | HF API、2026-09-12 |
| サーブレシピ | 8 x H100、tp 8 | 同カード |
| OpenRouter Pro | 入力/出力 $0(:free)、262,144 ctx | OpenRouter API、2026-09-12 |
| ソフトウェア価格 | 重み $0 | Apache-2.0 |
カード引用の Pro スコア(ベンダー数字として扱う):Terminal-Bench 2.1 82.7、SWE-Bench Pro 61.2、OSWorld-Verified 82.2、BrowseComp 89.7。
使用シナリオ
- 8 枚の H100 を出せるローカルエージェントチームで、mini より大きい Apache-2.0 コンピュータ操作チェックポイントが欲しい場合。
- Nex-N2.5 のサイズを比較する人で、1.6T Max でも Nex-N2.5-mini でもなく Pro が必要な場合。
- r/LocalLLaMA の読者。407GB のホット見出しを見た人。
密なローカル 27B チャットモデルが必要なら Qwen3.8-27B から始めてください。
はじめに
- nex-agi/Nex-N2.5-Pro を開く。
nexagi/sglang:v0.5.18-nex-patchを引き、重みをマウント。--tp 8 --reasoning-parser qwen3 --tool-call-parser qwen3_coderと Pro チャットテンプレートで起動。- 常時思考または無思考が要る場合以外は
reasoning_effortを"medium"に。
一次資料:Nex-N2.5-Pro モデルカード。サイト:nex-agi.com。
よくある質問
Pro は Max と同じですか?
違います。Mini と Pro はマルチモーダル。Max は兆スケールのテキスト専用 MoE です。
2 枚の H100 で足りますか?
公開されている Pro レシピは 8 x H100。Mini が 2 x H100 です。小さい箱を約束する前に VRAM を確認してください。
SWE の数字は Claude Opus 5 と比較できますか?
カード表では SWE-Bench Pro で Pro は Opus 5 より下(61.2 vs 79.2)。ベンダー行です。
代替案
- Nex-N2.5-mini:同じ家族、35B サーブレシピ。
- Qwen3.8-Flash-Next:RAM 常駐 n-gram 表付きの疎なオープン MoE。
- GLM-5.3-Flash:自前ホストしたくない場合のホスト高速 SKU。
ヒント
- Nex の SGLang イメージを使う。在庫 wheel はチャットテンプレートを欠くことがあります。
- 推論を $0 と予算する前に OpenRouter
:freeを再確認。 - Max や mini のスコアをこの Pro ページにコピーしない。
Nex-N2.5-Pro は r/LocalLLaMA が 2026-09-12 にリンクした Apache-2.0 約 397B エージェントチェックポイントです。Hugging Face カードから始め、mini またはホスト :free 席で足りるか判断してください。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。
Codex を閉じ込めているのはモデルではなく、ピッカーだ
OpenCode Go、Grok、Z.ai にはすでに課金しているのに、Codex のピッカーはほぼ GPT しか出さない。コミュニティ製の codex-router が教えるのは手順ではない。すでに買ったモデル能力をセレクタに戻すこと。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。
Windows で OpenCode Go を Codex に繋ぐ。二セット目のツールは開くな
ChatGPT でログインした Codex デスクトップは、ピッカーにほぼ GPT しか出さない。Windows では OpenCode Go だけを開けば、すでに課金している Grok、GLM、Kimi、DeepSeek、MiniMax が同じセレクタに戻る。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。