跳到正文
热点事件持续更新

Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2

7 篇报道7 个报道来源23 小时前更新

先了解这件事

AI 综述

Google DeepMind 发布了 EmbeddingGemma 2,一个 7.4 亿参数的开源多模态嵌入模型,可将文本、代码、图像、音频和视频映射到统一的 768 维向量空间。该模型采用 Apache 2.0 许可,模型权重已在 Hugging Face 和 Kaggle 上提供,并支持在手机等端侧设备本地运行。 根据报道,该模型在量化后于 Pixel 11 Pro 上运行时,纯文本任务内存占用约 191MB,全模态任务内存占用约 567MB。Google 称其支持超过 100 种语言,但性能并不均等,且模型未进行安全调优。 开发者 Simon Willison 评论称,Apache 2.0 许可证允许用户自行托管模型,避免了供应商锁定风险。Google 表示,该模型也将很快登陆 Gemini Enterprise Agent Platform 的 Model Garden。

AI 根据报道生成 · 21 小时前更新

事件进展

2 个进展

  1. 10月7日 04:37 · 1 篇报道
    Simon Willison评论EmbeddingGemma 2开源优势
    Simon Willison:EmbeddingGemma 2 发布:开源许可与可迁移性优势
  2. 10月7日 02:36 · 6 篇报道
    Google DeepMind 发布 EmbeddingGemma 2
    Google DeepMind:Google DeepMind 发布 EmbeddingGemma 2 多模态嵌入模型

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. IT之家精选
    谷歌推出 EmbeddingGemma 2:支持多模态、7.4 亿参数量化手机端运行只需 191MB 内存

    谷歌推出 EmbeddingGemma 2,基于 Gemma 4 架构,支持文本、代码、图像、视频、音频统一嵌入,总参数 7.4 亿,量化后在 Pixel 11 Pro 上纯文本运行仅需 191MB 内存。

  2. SiliconANGLE精选
    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布 EmbeddingGemma 2,基于 Gemma 4 架构,支持文本、图像、音频和视频的统一嵌入空间,参数量达 7.4 亿,可在智能手机上运行。模型在代码检索任务上得分 78.68,比初版提升近 10 分,支持 Matryoshka 表示学习压缩嵌入向量,权重已在 Hugging Face 和 Kaggle 开源,Apache 2.0 许可允许商业使用。

  3. Simon Willison
    EmbeddingGemma 2 发布:开源许可与可迁移性优势

    EmbeddingGemma 2 在 Apache 2.0 许可下发布,支持用户无需自行托管即可使用,同时保留了模型权重的开源特性。该模型适用于需要大量嵌入向量计算和存储的应用场景,避免了因供应商停止服务而需重新计算已有数据的问题。用户可选择付费使用托管版本,或在需要时自行运行开源权重版本。

  4. Google DeepMind精选
    Google DeepMind 发布 EmbeddingGemma 2 多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构的开源轻量级多模态嵌入模型,支持文本、图像、音频和视频统一映射到嵌入空间,参数量 7.4 亿,支持 8K token 上下文窗口,适用于端侧推理。

  5. The Decoder
    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布 EmbeddingGemma 2,一个7.4亿参数的开源多模态嵌入模型,可将文本、图像、视频、音频和代码转换为向量,支持本地运行无需API密钥,单次查询耗时20-70毫秒,仅需约191MB内存。

  6. The Next Web精选
    Google 发布 EmbeddingGemma 2,支持文本、代码、图像、音频和视频的端侧多模态嵌入

    Google 发布 EmbeddingGemma 2,一个开源的7.4亿参数多模态嵌入模型,支持文本、代码、图像、音频和视频映射到统一768维空间,可在手机或小型开发板上本地运行,内存占用约191MB(文本)至567MB(全模态),采用Apache 2.0许可,无安全调优,支持100多种语言,上下文窗口达8,192 tokens,向量可压缩至128维。

  7. MarkTechPost精选
    Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 的 740M 开源多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,支持文本、代码、图像、视频和音频,共享 768 维向量空间,上下文窗口 8K token,采用 Apache 2.0 许可。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。