谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

核心内容摘要

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索没有连着弹窗求好评,页面清静,注意力能留给内容。内容更新偏稳,宁缺毋滥,注水感不强。像咖啡因为什么让人醒这种问题,讲解顺序清楚,不太把人劝退。有种被好好对待的感觉,而不是被算法拽着满世界乱跑。后面会继续追专题,尤其是那些可迁移的硬核基础。把核心求知需求解决得很扎实。

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

谷歌于周一推出EmbeddingGemma 2,这是其面向设备端部署的多模态嵌入模型新一代产品,可在本地硬件上统一处理文本、图像、音频与视频,主打数据隐私保护与离线推理能力,对移动端AI应用开发者具有直接吸引力。 谷歌表示,该模型在MTEB代码评测中较上一代提升9.92分,并在sub-1B规模多模态嵌入模型中取得领先基准成绩,部分指标甚至超越体量两倍以上的专项模型。 上一代产品EmbeddingGemma自发布以来已累计超过2000万次下载,此次升级将嵌入能力从纯文本扩展至多模态,有望进一步扩大谷歌在端侧AI基础设施领域的开发者生态优势。 EmbeddingGemma 2的核心设计逻辑是在有限硬件资源下实现高质量多模态推理。模型采用模块化架构,纯文本工作负载仅需约2.7亿参数,视觉编码器(1.7亿参数)与音频编码器(3亿参数)可按需加载,全模态版本总参数量为7.4亿。 谷歌公布的测试数据显示,在经过量化处理后,该模型在Google Pixel 11 Pro上运行时,纯文本权重仅需约191MB活跃内存,全多模态模式所需内存约为567MB。对于内存受限的消费级设备而言,这一指标具有实际部署意义。 在存储效率层面,模型引入Matryoshka表示学习(MRL)技术,允许开发者将输出向量从768维动态截断至512、256或128维,最高可实现本地向量数据库6倍的存储压缩比。 EmbeddingGemma 2将上下文窗口扩展至8K token,是上一代4倍,可在本地硬件上直接处理最长约5.5分钟的音频、29张图像、58帧视频,或上述模态的交错组合输入。 这一能力使跨模态语义检索场景在端侧变得可行,例如通过语音备忘录定位特定视频片段,或基于文本查询检索多小时音频录音。 在代码检索能力上,模型在MTEB Code基准测试中从68.76分提升至78.68分,升幅达9.92分,适用于本地代码库索引、语义代码搜索及编程智能体检索等场景。 谷歌指出,本地生成嵌入有助于确保数据隐私、降低流水线延迟,并使跨模态搜索与检索功能在完全离线状态下运行。这一定位与当前部分企业和开发者对数据主权和隐私合规的关注相契合。

📕作者: 杜天贞撰 · 更新于 2026-10-07 10:59:58

✔《遗产是美人兄弟(双)渡鸦》多特希望卡雷察斯轮休,希腊主帅:我不会给任何俱乐部优待

🍑8x8x中场控制方面,德国预计会依靠亚历山大-帕夫洛维奇的回收和维尔茨、比朔夫的向前传递掌握主动。希腊则需要利用4-4-2的横向站位封锁中路,尽量避免维尔茨在肋部轻松接球。如果德国能够持续把球送到禁区前沿,希腊的防线将承受较大压力。今年的临床医学研究奖授予了中外制药株式会社的服部邦洋、北泽武久和井川智之,以表彰他们发明了一种能够连接凝血因子IX和凝血因子X的双特异性抗体。凭借这一突破,三位科学家恢复了A型血友病患者缺失的俗称“凝血八因子”的活性,能够预防这一遗传性疾病所导致的严重出血。

🖤《ACFun网页》德天空:拜仁认为乌尔比希身边还需要一名经验丰富的替补门将

👅韩剧《我的大叔》在存储效率层面,模型引入Matryoshka表示学习(MRL)技术,允许开发者将输出向量从768维动态截断至512、256或128维,最高可实现本地向量数据库6倍的存储压缩比。

💔歪歪漫画网这不是各高校临时自主调整,而是教育部全国统一招生政策。最新发布的《2027年全国硕士研究生招生工作管理规定》进一步明确,报考工程管理专业学位,需要满足相应的工作经验要求。这意味着,此前已经预告的政策调整正式落地,工业工程与管理(125603)、物流工程与管理(125604)不再接受普通应届本科毕业生直接报考。

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

📸 记者 刘朝众 摄 · 更新于 2026-10-07 10:59:58

相关标签

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索: 本文详细介绍了谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索没有连着弹窗求好评,页面清静,注意力能留给内容。内容更新偏稳,宁缺毋滥,注水感不强。像咖啡因为什么让人醒这种问题,讲解顺序清楚,不太把人劝退。有种被好好对待的感觉,而不是被算法拽着满世界乱跑。后面会继续追专题,尤其是那些可迁移的硬核基础。把核心求知需求解决得很扎实。

关键词:谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索