Nex-N2.5-Pro 是 Nex-AGI 的 Nex-N2.5 智能体家族里的中规格。Hugging Face 卡片 协议 Apache-2.0,pipeline 为 text-generation,架构 qwen3_5_moe。2026-09-12 Hugging Face 显示 595 likes、近 30 天 12,260 次下载。createdAt 为 2026-09-08。API 上 safetensors 合计约 396.8B 参数。r/LocalLLaMA 热门帖标题写成「Nex N2.5 Pro (407GB) released」;把 407GB 当成社区标签,不是第一方字节数。
家族还有 mini 和 Max。Max 被写成 1.6T 纯文本 MoE。本页只写 Pro 权重,不是 Max,也不是 Nex-N2.5-mini。
对照 Nex-N2.5-mini 若你要 35B 配方,对照 Qwen3.8-Flash-Next 若你要阿里的稀疏开源 MoE,对照 GLM-5.3-Flash 若你要便宜的托管快规格。
核心功能
- 智能体多模态:卡片写 mini 和 Pro 沿用 Nex-N2 的计算机使用、浏览和视觉落地智能体路径。视觉被写成核验结果的接口,不只是输入。
- 思考模式:
reasoning_effort为"none"、"medium"(默认自适应)或"high"。聊天模板用这个字段,不是通用的enable_thinking。 - 部署:定制 SGLang 镜像
nexagi/sglang:v0.5.18-nex-patch。Pro 配方是单机 8 x H100,--tp 8,--reasoning-parser qwen3,--tool-call-parser qwen3_coder。 - 卡片采样:
temperature0.7,top_p0.95,top_k40。 - 托管路径:2026-09-12 OpenRouter 列出
nex-agi/nex-n2.5-pro:free,价格 $0 / $0,上下文 262,144。承诺免费席位前再核一次 slug。
局限:GitHub 镜像 nex-agi/Nex-N2.5 在 2026-09-12 只有 96 star。卡片上的基准表是第一方,常用 NexAU / NexCUA 套件。我们没有重跑。595 likes 是热度信号,不是审计。
规格
| 项 | 值 | 来源 |
|---|---|---|
| 参数量(safetensors) | 约 396.8B | HF API,2026-09-12 |
| 协议 | Apache-2.0 | HF 卡片 |
| Likes / 近 30 天下载 | 595 / 12,260 | HF API,2026-09-12 |
| 部署配方 | 8 x H100,tp 8 | 同一卡片 |
| OpenRouter Pro | 输入/输出 $0(:free),262,144 上下文 | OpenRouter API,2026-09-12 |
| 软件价格 | 权重 $0 | Apache-2.0 |
卡片引用的 Pro 分数(当厂商数字看):Terminal-Bench 2.1 82.7,SWE-Bench Pro 61.2,OSWorld-Verified 82.2,BrowseComp 89.7。
适用场景
- 能拿出八张 H100 的本地智能体团队,要一份比 mini 更大的 Apache-2.0 计算机使用检查点。
- 在比较 Nex-N2.5 规格、需要 Pro 而不是 1.6T Max、也不是 Nex-N2.5-mini 的人。
- r/LocalLLaMA 读者,看到 407GB 热门标题。
若你要稠密的本地 27B 聊天模型,从 Qwen3.8-27B 开始。
快速开始
- 打开 nex-agi/Nex-N2.5-Pro。
- 拉取
nexagi/sglang:v0.5.18-nex-patch并挂上权重。 - 用
--tp 8 --reasoning-parser qwen3 --tool-call-parser qwen3_coder和 Pro 聊天模板启动。 - 除非要始终思考或完全不思考,把
reasoning_effort设为"medium"。
第一方资料:Nex-N2.5-Pro 模型卡片。网站:nex-agi.com。
常见问题
Pro 等于 Max 吗?
不等于。Mini 和 Pro 是多模态。Max 是万亿规模纯文本 MoE。
两张 H100 能跑吗?
公布的 Pro 配方是 8 x H100。Mini 才是 2 x H100。承诺更小机器前先核显存。
SWE 数字能和 Claude Opus 5 比吗?
卡片表里 Pro 在 SWE-Bench Pro 低于 Opus 5(61.2 vs 79.2)。那是厂商行。
替代方案
- Nex-N2.5-mini:同一家族,35B 部署配方。
- Qwen3.8-Flash-Next:带内存 n-gram 表的稀疏开源 MoE。
- GLM-5.3-Flash:不想自托管时的托管快规格。
使用技巧
- 用 Nex 的 SGLang 镜像。库存 wheel 可能缺聊天模板。
- 把推理预算写成 $0 之前,再核一次 OpenRouter
:free。 - 不要把 Max 或 mini 的分数抄到本页。
Nex-N2.5-Pro 是 r/LocalLLaMA 在 2026-09-12 链到的 Apache-2.0 约 397B 智能体检查点。从 Hugging Face 卡片开始,再决定 mini 或托管 :free 席位是否已经够用。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察
7 款 AI 编程 CLI 用了半年,我悟出一个道理:模型再强,干活也要有监督
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness 各有性格。半年深度使用后我总结出一套分工矩阵:pi 做最省事的 CR、omp 审复杂 PR、DeepSeek Harness 配 V4 Flash 高频低成本审查、Claude Code 与 Qoder 写代码。模型再强,干活也要有监督,而且最好是独立第三方。
Claudesidian:让 Obsidian 变成 AI 驱动的第二大脑
通过 Claudesidian 这个开源项目,将 Obsidian 笔记系统与 Claude Code 完美结合。内置 PARA 方法、自定义命令、自动化工作流,从想法到实现的完整解决方案。
锁死 Codex 的不是模型,是选择器
你已经为 OpenCode Go、Grok、Z.ai 付过钱了,但 Codex 的 picker 默认只露出 GPT。社区项目 codex-router 做的不是再教一遍安装步骤,而是把已经买过的模型能力接回选择器:密钥不出本机,原生 GPT 也不动。