前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
AI 大模型/10.07 · 03:57/3 MIN/编译自 Google DeepMind/1 阅读

Google 发布轻量多模态模型 EmbeddingGemma 2

Google DeepMind 正式推出开源多模态嵌入模型 EmbeddingGemma 2,参数量仅 7.4 亿,原生支持文本、图像、音频与视频的统一向量映射,为端侧检索与多模态 RAG 带来高性能低功耗解决方案。

Google 发布轻量多模态模型 EmbeddingGemma 2

Google DeepMind 正式发布轻量级多模态向量嵌入模型 EmbeddingGemma 2。该模型基于 Gemma 4 架构开发,采用宽松的 Apache 2.0 开源许可协议,整体参数量仅 7.4 亿(740M),专为端侧设备高效推理而设计。

去年 Google 推出的第一代 EmbeddingGemma 在全球累计下载量超过 2000 万次。全新的 EmbeddingGemma 2 突破了纯文本局限,将代码、图像、音频与视频统一映射到同一个共享 Embedding 空间中。用户仅凭一条文本查询,即可检索数小时的音频录音,或通过一段语音备忘录准确定位特定视频片段。

核心技术亮点

  • 同体量性能领先:在 10 亿以下(Sub-1B)参数的多模态 Embedding 模型中,EmbeddingGemma 2 在 MTEB Code 与 MAEB 等基准评测上均取得顶尖成绩,甚至超越了部分体积两倍以上的专用模型。
  • 模块化架构:纯文本任务仅需加载 2.7 亿(270M)参数的基础模块;按需接入 1.7 亿参数视觉编码器和 3 亿参数音频编码器后,即可实现完整多模态支持。
  • 存储效率大幅优化:采用俄罗斯套娃表示学习(Matryoshka Representation Learning, MRL)技术,输出维度可从 768 维灵活截断至 512、256 或 128 维,为本地向量数据库最高节省 6 倍存储空间。
  • 极致端侧运行开销:在 Google Pixel 11 Pro 上经量化处理后,纯文本模型仅需约 191MB 活跃内存,完整多模态模型也仅占用约 567MB 内存。
  • 8K 超长上下文窗口:上下文窗口提升至 8K Token(第一代的 4 倍),支持直接在本地硬件处理最长 5.5 分钟的音频、29 张图像、58 帧视频,或这些模态的交错组合。

代码、视觉与音频基准表现

EmbeddingGemma 2 在保持出色多语言能力的同时,代码检索能力实现大幅跨越:在 MTEB Code 基准测试中得分从 68.76 跃升至 78.68(提升 9.92 分),非常适合用于本地代码库索引、语义代码搜索与编程 Agent 检索。

赋能完全离线的端侧检索与 RAG

在边缘端直接生成向量,不仅保障了用户数据隐私、降低了延迟,还能让开发者构建完全离线运行的跨模态检索系统。

当与 Gemma 4 等生成模型搭配时,EmbeddingGemma 2 能够构建起理解复杂多模态数据的端侧 RAG 流程。由于两者共享相同的分词器(Tokenizer)和音频编码器,联合部署时的综合内存占用得以进一步压降。

快速上手与生态支持

EmbeddingGemma 2 已与主流开源与端侧开发生态完成集成:

  • 模型权重获取:可在 Hugging Face 与 Kaggle 下载,针对端侧优化的版本已上线 LiteRT Community。
  • 端侧与浏览器部署:支持通过 Google AI Edge 的 MediaPipe 和 LiteRT 进行跨平台开发,也可借助 transformers.js 或 WebGPU 在浏览器中直接运行。
  • 开发框架兼容:全面适配 sentence-transformers、llama.cpp、Ollama、vLLM、SGLang、MLX 等常用推理工具,向量存储则原生适配 Qdrant。
  • 微调支持:开发者可参考 Unsloth 微调指南 定制专属模型。
标签:GoogleDeepMindEmbeddingRAG开源模型

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

Triton 为什么跑赢 CUDA:Meta 重写推荐系统嵌入算子的关键一步
置顶

Triton 为什么跑赢 CUDA:Meta 重写推荐系统嵌入算子的关键一步

新硬件接入 PyTorch:从补丁地狱到标准化工作流
置顶

新硬件接入 PyTorch:从补丁地狱到标准化工作流

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
表格预测搬进上下文:NVIDIA Kumo Tabular 不训练不调参
置顶

表格预测搬进上下文:NVIDIA Kumo Tabular 不训练不调参

//

24小时热榜

纽约州因麻疹疫情爆发宣布进入全州灾难紧急状态
TOP1

纽约州因麻疹疫情爆发宣布进入全州灾难紧急状态

Mistral发布万亿参数大模型ML4,开源权重月底上线
TOP2

Mistral发布万亿参数大模型ML4,开源权重月底上线

3

美国宾夕法尼亚州麻疹确诊破千,已致5人死亡

18小时前
美国宾夕法尼亚州麻疹确诊破千,已致5人死亡
4

AMD巨资收购World Labs,芯片巨头打响世界模型争夺战

23小时前
AMD巨资收购World Labs,芯片巨头打响世界模型争夺战
5

AI让个人效率翻倍,为何团队交付还是快不起来?

23小时前
AI让个人效率翻倍,为何团队交付还是快不起来?
6

麦当劳回应AI算法操纵菜品定价指控

23小时前
麦当劳回应AI算法操纵菜品定价指控
7

DeepSeek被曝将完成超800亿元新融资

3小时前
DeepSeek被曝将完成超800亿元新融资
8

苹果计划10月下旬开启第二波新品发布

3小时前
苹果计划10月下旬开启第二波新品发布
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断