HaiAI123

全球AI工具精选导航

新热点事件
285
热度指数
新上榜

DeepMind 发布 740M 多模态嵌入模型 EmbeddingGemma 2

2026/10/07 — 10/07 01:18·3 个来源(全部)·3 篇报道(全部)·入选 10-07 日报

事件概览

2026 年 10 月 6 日,Google DeepMind 在 Google 官方博客发布 EmbeddingGemma 2,由该团队研究工程师 Sahil Dua 和 Henrique Schechter Vera 公布。这是一个 740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本(含代码)、图像、视频、音频及其任意组合映射到统一的 768 维向量空间。据 Reddit 的 LocalLLaMA 板块介绍,740M 总参数由一个 270M 参数的文本模型,加上模块化的 170M 视觉编码器和 300M 音频编码器组成,面向手机、笔记本等消费级硬件运行,模型页面位于 Hugging Face 的 google/embeddinggemma-2。Google 称其是端侧多模态嵌入能力最强的模型。

10 月 7 日,Techmeme、Reddit 与 Unite.AI 先后报道了这一发布。几家在模态范围的表述上略有出入:Techmeme 写的是把代码、图像、视频和音频映射到同一嵌入空间;Unite.AI 写的是文本、代码、图像、视频和音频五种模态映射到同一个 768 维嵌入空间;Reddit 的表述则是文本(含代码)、图像、视频、音频及其任意组合。目前事情停在发布与开源这一步,材料中没有更多后续进展。

AI 综合 3 篇报道生成 · 更新于 1 小时前

最新进展据 Unite.AI 报道,Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源模型,可把文本、代码、图像、视频和音频映射到同一个 768 维嵌入空间,采用 Apache 2.0 许可并面向消费级硬件运行。该模型由研究工程师 Sahil Dua 和 Henrique Schechter Vera 在 Google 官方博客上公布。

24 小时热度热度指数 285
刚上榜,走势正在积累
24 小时前现在

这件事的报道 点标题看原文

今天
  1. 据 Unite.AI 报道,Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源模型,可把文本、代码、图像、视频和音频映射到同一个 768 维嵌入空间,采用 Apache 2.0 许可并面向消费级硬件运行。该模型由研究工程师 Sahil Dua 和 Henrique Schechter Vera 在 Google 官方博客上公布。

    轻量开源多模态嵌入模型,适合端侧检索

    Unite.AIAI 评分 60
  2. Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,可把文本(含代码)、图像、视频、音频及其任意组合映射到统一的 768 维向量空间。模型总参数 740M,由 270M 文本模型与 170M 视觉、300M 音频编码器组成,面向手机、笔记本等消费级硬件运行。

    多模态嵌入走向端侧,开发者可直接下载复用。

    Reddit · LocalLLaMAAI 评分 62
  3. Google 发布 EmbeddingGemma 2,这是一个 740M 参数的多模态嵌入模型,可把代码、图像、视频和音频映射到同一嵌入空间,采用 Apache 2.0 许可。Google 称其是目前端侧多模态嵌入能力最强的模型。

    开源端侧多模态嵌入模型,可直接本地部署

    TechmemeAI 评分 60

同时在说的其他事

热度怎么算的?了解口径

热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。

本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加

回热点事件榜 →