Nex-N2.5-mini 是 Nex-AGI 的 Nex-N2.5 智能体家族里的小规格。 Hugging Face 卡片 协议 Apache-2.0,pipeline 为 image-text-to-text,架构 qwen3_5_moe。2026-09-09 Hugging Face 显示 62 likes、近 30 天 2 次下载。createdAt 为 2026-09-08。卡片 safetensors 合计约 35.1B 参数。r/LocalLLaMA 当天把卡片放在热门列表。
家族还有 Pro 和 Max。Max 被写成 1.6T 纯文本 MoE。本页只写 mini 权重,不是 Max。
若要阿里稀疏开源 MoE,看 Qwen3.8-Flash-Next。若要截图加文本的 Flash VLM,看 DeepSeek-V4-Flash-Vision-Exp。若要便宜的托管快规格,看 GLM-5.3-Flash。
核心功能
- 智能体多模态:卡片写 mini 和 Pro 延续 Nex-N2 的计算机使用、浏览和视觉落地智能体路径。视觉被写成核验结果的接口,不只是输入。
- 思考模式:
reasoning_effort为"none"、"medium"(默认自适应)或"high"。聊天模板用这个字段,不是通用的enable_thinking。 - 部署:定制 SGLang 镜像
nexagi/sglang:v0.5.18-nex-patch。mini 配方是单机 2 x H100,--tp 2,--reasoning-parser qwen3,--tool-call-parser qwen3_coder。 - 卡片采样:
temperature0.7,top_p0.95,top_k40。 - 托管路径:2026-09-09 OpenRouter 列出
nex-agi/nex-n2.5-mini:free,价格 $0 / $0。承诺免费席位前再核一次 slug。
限制:GitHub 镜像 nex-agi/Nex-N2.5 当天只有 18 stars。卡片基准表是第一方数字,常用 NexAU / NexCUA harness。我们没有复跑。首日 62 likes 是热度,不是审计。
规格
| 项目 | 数值 | 来源 |
|---|---|---|
| 参数(safetensors) | 约 35.1B | HF API,2026-09-09 |
| 协议 | Apache-2.0 | HF 卡片 |
| likes / 近 30 天下载 | 62 / 2 | HF API,2026-09-09 |
| 部署配方 | 2 x H100,tp 2 | 同一卡片 |
| OpenRouter mini | $0 入 / $0 出(:free) | OpenRouter API,2026-09-09 |
| 软件价格 | $0 权重 | Apache-2.0 |
卡片引用的 mini 分数(当厂商数字):Terminal-Bench 2.1 73.4,SWE-Bench Pro 43.8,OSWorld-Verified 71.2,BrowseComp 83.4。
适用场景
- 本地智能体团队,能拿出两张 H100,想要 Apache-2.0 的计算机使用权重。
- 比较 Nex-N2.5 规格的人,只要 mini,不要 1.6T Max。
- r/LocalLLaMA 读者,在热门列表看到 HF 链接。
若要稠密本地 27B 对话模型,从 Qwen3.8-27B 开始。
快速开始
- 打开 nex-agi/Nex-N2.5-mini。
- 拉取
nexagi/sglang:v0.5.18-nex-patch并挂载权重。 - 用
--tp 2 --reasoning-parser qwen3 --tool-call-parser qwen3_coder和 mini 聊天模板启动。 - 除非要永远思考或完全不思考,把
reasoning_effort设为"medium"。
第一方资源:Nex-N2.5-mini 模型卡。官网:nex-agi.com。
常见问题
mini 等于 Max 吗?
不等于。Mini 和 Pro 是多模态。Max 是万亿级纯文本 MoE。
一张 4090 能跑吗?
公布的配方是 2 x H100。承诺桌面机能跑之前先核显存。
SWE 数字能和 Claude Opus 5 比吗?
卡片表里 mini 的 SWE-Bench Pro 是 43.8,Opus 5 是 79.2。那些是厂商行。
替代方案
- Qwen3.8-Flash-Next:稀疏开源 MoE,带内存驻留 n-gram 表。
- DeepSeek-V4-Flash-Vision-Exp:MIT Flash 视觉实验。
- GLM-5.3-Flash:不想自托管时的托管快规格。
使用技巧
- 用 Nex 的 SGLang 镜像。库存 wheel 可能缺聊天模板。
- 做 $0 推理预算前再核 OpenRouter
:free。 - 不要把 Max 或 Pro 的分数抄到本页。
Nex-N2.5-mini 是 r/LocalLLaMA 在 2026-09-08 挂出的 Apache-2.0 35B 智能体权重。从 Hugging Face 卡片起步,再判断 Pro 或托管 :free 是否已经够用。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察
7 款 AI 编程 CLI 用了半年,我悟出一个道理:模型再强,干活也要有监督
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness 各有性格。半年深度使用后我总结出一套分工矩阵:pi 做最省事的 CR、omp 审复杂 PR、DeepSeek Harness 配 V4 Flash 高频低成本审查、Claude Code 与 Qoder 写代码。模型再强,干活也要有监督,而且最好是独立第三方。
Claudesidian:让 Obsidian 变成 AI 驱动的第二大脑
通过 Claudesidian 这个开源项目,将 Obsidian 笔记系统与 Claude Code 完美结合。内置 PARA 方法、自定义命令、自动化工作流,从想法到实现的完整解决方案。
锁死 Codex 的不是模型,是选择器
你已经为 OpenCode Go、Grok、Z.ai 付过钱了,但 Codex 的 picker 默认只露出 GPT。社区项目 codex-router 做的不是再教一遍安装步骤,而是把已经买过的模型能力接回选择器:密钥不出本机,原生 GPT 也不动。