Nex-N2.5-mini は Nex-AGI の Nex-N2.5 エージェント家族の小型 SKU です。Hugging Face カード のライセンスは Apache-2.0、pipeline は image-text-to-text、アーキテクチャは qwen3_5_moe。2026-09-09 の Hugging Face は 62 likes、直近 30 日 2 ダウンロード。createdAt は 2026-09-08。カードの safetensors 合計は約 35.1B パラメータ。r/LocalLLaMA はその日ホットリストにカードを載せました。
家族には Pro と Max もあります。Max は 1.6T のテキスト専用 MoE と書かれます。このページは mini チェックポイントであり、Max ではありません。
Alibaba の疎なオープン MoE が欲しいなら Qwen3.8-Flash-Next。スクリーンショットとテキストの Flash VLM なら DeepSeek-V4-Flash-Vision-Exp。安価なホスト高速 SKU なら GLM-5.3-Flash。
主な機能
- エージェント的マルチモーダル:カードは mini と Pro が Nex-N2 のコンピュータ操作、閲覧、視覚接地エージェント経路を継ぐと書く。視覚は入力だけでなく、結果を検証するインターフェースとして位置づけられる。
- 思考モード:
reasoning_effortは"none"、"medium"(既定の適応)、"high"。チャットテンプレートはこのフィールドを使い、汎用のenable_thinkingではない。 - サーブ:カスタム SGLang イメージ
nexagi/sglang:v0.5.18-nex-patch。mini のレシピは単一ノード 2 x H100、--tp 2、--reasoning-parser qwen3、--tool-call-parser qwen3_coder。 - カードのサンプリング:
temperature0.7、top_p0.95、top_k40。 - ホスト経路:2026-09-09 の OpenRouter は
nex-agi/nex-n2.5-mini:freeを $0 / $0 と列挙。無料席を約束する前に slug を再確認。
制約:GitHub ミラー nex-agi/Nex-N2.5 はその日 18 stars。カードのベンチ表は第一ソースで、NexAU / NexCUA ハーネスで測っていることが多い。再実行していない。初日 62 likes は熱量であり監査ではない。
仕様
| 項目 | 値 | 出典 |
|---|---|---|
| パラメータ(safetensors) | 約 35.1B | HF API、2026-09-09 |
| ライセンス | Apache-2.0 | HF カード |
| likes / 直近 30 日 DL | 62 / 2 | HF API、2026-09-09 |
| サーブレシピ | 2 x H100、tp 2 | 同カード |
| OpenRouter mini | $0 in / $0 out(:free) | OpenRouter API、2026-09-09 |
| ソフトウェア価格 | $0 重み | Apache-2.0 |
カード引用の mini スコア(ベンダー数字として扱う):Terminal-Bench 2.1 73.4、SWE-Bench Pro 43.8、OSWorld-Verified 71.2、BrowseComp 83.4。
使用シナリオ
- 2 枚の H100 を用意できるローカルエージェントチームで、Apache-2.0 のコンピュータ操作チェックポイントが欲しい場合。
- Nex-N2.5 のサイズを比較する人で、mini が必要で 1.6T Max は不要な場合。
- ホットリストで HF リンクを見た r/LocalLLaMA 読者。
密なローカル 27B チャットモデルが必要なら Qwen3.8-27B から。
はじめに
- nex-agi/Nex-N2.5-mini を開く。
nexagi/sglang:v0.5.18-nex-patchを引き、重みをマウント。--tp 2 --reasoning-parser qwen3 --tool-call-parser qwen3_coderと mini チャットテンプレートで起動。- 常時思考か無思考が要る場合以外は
reasoning_effortを"medium"に。
第一ソース:Nex-N2.5-mini モデルカード。サイト:nex-agi.com。
よくある質問
mini は Max と同じですか?
違います。Mini と Pro はマルチモーダル。Max は兆パラメータ級のテキスト専用 MoE です。
4090 一枚で動きますか?
公開レシピは 2 x H100。デスクトップを約束する前に VRAM を確認。
SWE 数字は Claude Opus 5 と比較できますか?
カード表では mini の SWE-Bench Pro は 43.8、Opus 5 は 79.2。ベンダー行です。
代替案
- Qwen3.8-Flash-Next:RAM 常駐 n-gram 表を持つ疎なオープン MoE。
- DeepSeek-V4-Flash-Vision-Exp:MIT の Flash 視覚実験。
- GLM-5.3-Flash:自ホストしたくない場合のホスト高速 SKU。
ヒント
- Nex の SGLang イメージを使う。在庫ホイールはチャットテンプレートを欠くことがある。
- $0 推論を予算に入れる前に OpenRouter
:freeを再確認。 - Max や Pro のスコアをこの mini ページにコピーしない。
Nex-N2.5-mini は r/LocalLLaMA が 2026-09-08 にリンクした Apache-2.0 の 35B エージェントチェックポイントです。Hugging Face カードから始め、Pro かホスト :free ですでに足りるか判断してください。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。
Codex を閉じ込めているのはモデルではなく、ピッカーだ
OpenCode Go、Grok、Z.ai にはすでに課金しているのに、Codex のピッカーはほぼ GPT しか出さない。コミュニティ製の codex-router が教えるのは手順ではない。すでに買ったモデル能力をセレクタに戻すこと。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。
Windows で OpenCode Go を Codex に繋ぐ。二セット目のツールは開くな
ChatGPT でログインした Codex デスクトップは、ピッカーにほぼ GPT しか出さない。Windows では OpenCode Go だけを開けば、すでに課金している Grok、GLM、Kimi、DeepSeek、MiniMax が同じセレクタに戻る。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。