模型发布
Google 发布开源多模态嵌入模型 EmbeddingGemma 2
事件时间 3 个独立来源编辑评分 79/100本站更新
先了解这件事
Google 发布了 Apache 2.0 许可的 EmbeddingGemma 2。该 7.4 亿参数模型将文本、代码、图像、音频和视频映射到统一嵌入空间,并面向设备端检索。
变化是什么
EmbeddingGemma 从文本嵌入扩展为原生多模态嵌入,模型权重已在 Hugging Face 和 Kaggle 提供。
对你意味着什么
开发者可在本地构建跨文本、媒体和代码的语义检索流程,但完整多模态部署仍须评估设备内存与编码器开销。
Google 于 10 月 6 日发布了 EmbeddingGemma 2。这一 Apache 2.0 许可的开放模型,将文本、代码、图像、音频和视频映射到统一嵌入空间,面向可在本地设备上运行的隐私优先语义检索。
官方称模型共 7.4 亿参数;文本工作负载可只使用 2.7 亿参数,视觉和音频编码器可按需加入。它让本地 RAG、媒体库搜索与多模态分类能够用同一嵌入模型覆盖更多输入类型。实际采用前仍应按目标硬件和输入模态测试内存与质量。详见 Google DeepMind 公告。
事实核查
报道时间线
- 一手来源GoogleGoogle
- 一手来源Google DeepMindGoogle DeepMind
- 报道Simon WillisonSimon Willison