跳到正文
热点事件持续更新

DeepMind发布开源多模态嵌入模型EmbeddingGemma 2

2 篇报道2 个报道来源2 小时前更新

先了解这件事

AI 综述

Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,基于 Gemma 4 架构,将文本、代码、图像、视频和音频统一映射到同一嵌入空间,权重已在 Hugging Face 和 Kaggle 开放,Gemini Enterprise Agent Platform Model Garden 即将提供。 纯文本任务最低可用 270M 参数版,视觉(170M)和音频(300M)编码器可选;量化后在 Pixel 11 Pro 上纯文本约需 191MB 内存,完整多模态约 567MB。 Google 称其 740M 参数性能超越两倍大小的竞品,在 MTEB(Code)上得分 78.68,较前代提升近 10 分。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Google DeepMind精选
    Google DeepMind 发布开源轻量级多模态嵌入模型 EmbeddingGemma 2

    Google DeepMind 发布开源轻量级多模态嵌入模型 EmbeddingGemma 2,基于 Gemma 4 架构,以 740M 参数将文本、代码、图像、视频和音频统一映射到同一嵌入空间。

  2. The Decoder
    Google 称 EmbeddingGemma 2 性能超越体型两倍的竞品嵌入模型

    Google 发布 EmbeddingGemma 2 开放嵌入模型,可将文本、图像、视频、音频和代码转为向量,官方称其 740M 参数性能超越两倍大小竞品。它在 MTEB(Code)上得分 78.68,较前代提升近 10 分,本地运行无需 API 密钥,约 191MB 内存即可支持离线 RAG。权重已在 Hugging Face 和 Kaggle 开放,纯文本任务可选 270M 参数版本。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。