模型发布

Google 发布开源多模态嵌入模型 EmbeddingGemma 2

事件时间 3 个独立来源编辑评分 79/100本站更新

先了解这件事

Google 发布了 Apache 2.0 许可的 EmbeddingGemma 2。该 7.4 亿参数模型将文本、代码、图像、音频和视频映射到统一嵌入空间,并面向设备端检索。

变化是什么

EmbeddingGemma 从文本嵌入扩展为原生多模态嵌入,模型权重已在 Hugging Face 和 Kaggle 提供。

对你意味着什么

开发者可在本地构建跨文本、媒体和代码的语义检索流程,但完整多模态部署仍须评估设备内存与编码器开销。

Google 于 10 月 6 日发布了 EmbeddingGemma 2。这一 Apache 2.0 许可的开放模型,将文本、代码、图像、音频和视频映射到统一嵌入空间,面向可在本地设备上运行的隐私优先语义检索。

官方称模型共 7.4 亿参数;文本工作负载可只使用 2.7 亿参数,视觉和音频编码器可按需加入。它让本地 RAG、媒体库搜索与多模态分类能够用同一嵌入模型覆盖更多输入类型。实际采用前仍应按目标硬件和输入模态测试内存与质量。详见 Google DeepMind 公告。

EmbeddingGemma

事实核查

  • 已核实Google 于 2026 年 10 月 6 日发布 EmbeddingGemma 2,并以 Apache 2.0 许可开放模型。依据
  • 已核实Google 称该模型有 7.4 亿参数,支持文本、代码、图像、音频和视频的统一嵌入。依据

报道时间线

  1. 一手来源Google
    Google
  2. 一手来源Google DeepMind
    Google DeepMind
  3. 报道Simon Willison
    Simon Willison