EmbeddingGemma 2开源并纳入Transformers
先了解这件事
2026年10月7日,Hugging Face Transformers 发布 v5.19.0,新增 Google 的多模态嵌入模型 EmbeddingGemma 2,并调整推理接口。该模型可将文本、图像、音频、视频及代码编码至统一的768维向量空间,并截断为512、256或128维。Google DeepMind 同日宣布模型开源,面向端侧推理;The Decoder 称,7.4亿参数版本在多模态嵌入基准上媲美规模达两倍的竞品,可通过 WebGPU 在浏览器本地运行,无需 API key,单次查询约20至70毫秒、内存需求约191 MB,权重已在 Hugging Face 和 Kaggle 提供。后续报道确认其采用 Apache 2.0 许可,并认为开放权重可降低服务停用后更换模型的成本。Android Authority 另报道,Google 推出 Mac 端 AI Edge Foresight 应用,并将 EmbeddingGemma 2 定位为隐私优先应用的超低延迟端侧决策引擎。
AI 根据报道生成 · 9 小时前更新
事件进展
- 10月7日 04:37 · 1 篇报道EmbeddingGemma 2 采用 Apache 2.0 许可Simon Willison:Simon Willison:EmbeddingGemma 2 采用 Apache 2.0 许可
- 10月7日 03:47 · 3 篇报道Google DeepMind发布多模态模型Google DeepMind Blog:Google DeepMind 发布开源轻量级多模态嵌入模型 EmbeddingGemma 2
- 10月7日 00:39 · 1 篇报道Transformers 发布 v5.19.0Hugging Face Transformers:Transformers v5.19.0 发布:新增 EmbeddingGemma2 并调整推理接口
报道时间线
沿着报道,了解事件的不同侧面。
- Android AuthorityGoogle推出Mac端AI Edge Foresight应用与EmbeddingGemma 2模型
Google宣布推出Mac端AI Edge Foresight应用,用于将简略项目符号扩展为完整格式的会议笔记。Google还发布了多模态端侧模型EmbeddingGemma 2,可处理文本文件、图片、视频帧和音频中的信息,并定位为面向隐私优先应用的超低延迟端侧决策引擎。
- Simon WillisonSimon Willison:EmbeddingGemma 2 采用 Apache 2.0 许可
EmbeddingGemma 2 采用 Apache 2.0 许可,Simon Willison 对此表示赞赏,并认为嵌入模型不宜依赖封闭、专有且仅能托管使用的服务。开放权重可让用户在服务商停止托管后自行运行模型,或转由其他服务商托管,避免为模型更换而重新计算并存储大量既有嵌入向量。
- Google DeepMind Blog精选Google DeepMind 发布开源轻量级多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,将代码、文本、图像、视频和音频映射到统一嵌入空间,面向端侧推理。
- The DecoderGoogle发布EmbeddingGemma 2,称其在多模态嵌入基准上媲美两倍规模模型
Google发布开放模型EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量;Google称其7.4亿参数版本在多模态嵌入基准上媲美规模达两倍的竞品。该模型可通过WebGPU在浏览器本地运行,无需API key,单次查询约20至70毫秒,内存需求约191 MB,权重已在Hugging Face和Kaggle提供。
- Hugging Face Transformers精选Transformers v5.19.0 发布:新增 EmbeddingGemma2 并调整推理接口
Transformers v5.19.0 新增 Google 的多模态嵌入模型 EmbeddingGemma2,可将文本、图像、音频和视频编码至共享的 768 维向量空间,并截断为 512、256 或 128 维。
本事件热度走势
当前热度 23·可比范围峰值 31(10月7日 15:00)·近 24 小时可比范围变化 -9%
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。