NV-Embed-v2
NV-Embed-v2 是 NVIDIA 2024 年的嵌入快照,不是 2026 MTEB 王冠。2026-08-17 复核:huggingface.co/nvidia/NV-Embed-v2 仍在。我们打开的卡仍在谈检索,以及大约 32768 token 的长上下文,不是一份新的「MTEB 第一 / 69.3」榜。旧的 最新 NVIDIA 嵌入 / MTEB 第一 / 平均 69.3 / 4096 当 2026 规格 不再沿用。
如果要仍在表里的 OpenAI v3 行,对比 text-embedding-3-large;如果要另一张 2024 开源嵌入卡,对比 BGE-M3。
核心功能
- 上一代 NVIDIA 卡:HF 页仍托管 NV-Embed-v2。许可、上下文和文件以该卡为准。
- 不是 2026 榜单:69.3 / 第一名不进表,除非你重跑一手 MTEB。
- 上下文不要默认 4096:我们打开的卡写的是更长的旧上下文。引活卡,不要引旧目录。
- 不编造 API 美元:引用托管行前先核 NVIDIA API 或 NIM。
适用场景
- 还拿着 2024 年 NV-Embed-v2 书签、需要改目录的人。
- 对比旧 NVIDIA 嵌入与计费 OpenAI v3 的人。
- 差点把 MTEB 第一贴进 2026 材料的人。
局限:这次没有重跑 MTEB,也没有调用活的 NVIDIA 嵌入接口。
定价方案
一手页,2026-08-17。
| 部分 | 价格 | 说明 |
|---|---|---|
| NV-Embed-v2 权重 | HF 卡仍在 | 许可和文件以该卡为准。 |
| 托管 NVIDIA API | 核 NVIDIA / NIM | 不要编造每百万美元。 |
如果旧博客还把 v2 写成当前 MTEB 第一,以本页为更正。
快速开始
- 下载权重前先打开 huggingface.co/nvidia/NV-Embed-v2。
- 如果要计费的 OpenAI v3 行,再核 text-embedding-3-large。
- 如果要另一张 2024 开源卡,再核 BGE-M3。
- 不要把 MTEB 69.3 贴进材料。
常见问题
NV-Embed-v2 还是 MTEB 第一吗?
不当 2026 普查。
它是 NVIDIA 最新嵌入吗?
不当活目录声明。先核 NVIDIA 文档有没有更新行。
和 BGE-M3 一样吗?
不一样。BGE-M3 是 2024 年智源多语言卡。本 slug 是 NVIDIA 的 2024 嵌入快照。
替代方案
- text-embedding-3-large:仍在表里的 OpenAI v3 large 行。
- BGE-M3:2024 开源多语言卡。
- text-embedding-3-small:更便宜的在表 OpenAI v3 行。
使用技巧
- 把 NV-Embed-v2 写成 2024 快照。
- 上下文和许可以活 HF 卡为准。
- 不要编造 2026 MTEB 名次。
总结
NV-Embed-v2 是仍在 Hugging Face 上的 2024 年 NVIDIA 嵌入快照,不是 2026 MTEB 第一名普查。从 huggingface.co/nvidia/NV-Embed-v2 起步,再决定 OpenAI v3 行是否已经覆盖你要的检索路径。
评论
还没有评论。成为第一个评论的人!
相关工具
text-embedding-3-large
developers.openai.com/api/docs/models/text-embedding-3-large
2024 年 OpenAI embedding 快照。复核:仍在目录。不是未审计的 2026 旗舰或 MIRACL 普查。
BGE-M3
huggingface.co/BAAI/bge-m3
2024 年 BAAI 多语言嵌入模型快照。复核:MIT 卡仍在。不是 2026 年 MIRACL 或 MTEB 王冠。
text-embedding-3-small
openai.com/api/pricing
上一代 OpenAI 嵌入快照。复核:定价页仍列每百万 $0.020。不是 2026 嵌入王冠,也不当最新里程碑或 23% 提升。
相关洞察

Grok Bot、Hermes Bot:一个人,终于配上了智囊团和秘书处
Grok Bot 进了 Cursor Pro+,Hermes Bot 能跑在 VPS 上。它们不是更聪明的聊天框。出主意的是智囊团,抓落实的是秘书处,拍板的还是你。
Windows 上把 OpenCode Go 接进 Codex,别再新开一套工具
ChatGPT 登录的 Codex 桌面版,默认选择器几乎只露出 GPT。Windows 上只开 OpenCode Go 这一家,就能把已经付过钱的 Grok、GLM、Kimi、DeepSeek、MiniMax 接回同一个 picker。密钥不出本机,原生 GPT 也不动。
锁死 Codex 的不是模型,是选择器
你已经为 OpenCode Go、Grok、Z.ai 付过钱了,但 Codex 的 picker 默认只露出 GPT。社区项目 codex-router 做的不是再教一遍安装步骤,而是把已经买过的模型能力接回选择器:密钥不出本机,原生 GPT 也不动。