新闻 回应

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

陈洪艮 阅读约 7 分钟 138773 阅读
谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索
配图:谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索

新闻导读

谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索长条目拆成上下篇,通勤读完一篇刚好,到站不憋屈。语言通俗,但没有把科学讲成尴尬段子,分寸拿得住。学习记录能看见看过哪些主题,有种在铺知识地图的感觉。朋友圈少转发谣言后,自己的信息环境都清净一点。真心觉得把时间交给它,比刷一堆情绪内容值。连续高强度翻看也不容易心累。

谷歌于周一推出EmbeddingGemma 2,这是其面向设备端部署的多模态嵌入模型新一代产品,可在本地硬件上统一处理文本、图像、音频与视频,主打数据隐私保护与离线推理能力,对移动端AI应用开发者具有直接吸引力。 谷歌表示,该模型在MTEB代码评测中较上一代提升9.92分,并在sub-1B规模多模态嵌入模型中取得领先基准成绩,部分指标甚至超越体量两倍以上的专项模型。 上一代产品EmbeddingGemma自发布以来已累计超过2000万次下载,此次升级将嵌入能力从纯文本扩展至多模态,有望进一步扩大谷歌在端侧AI基础设施领域的开发者生态优势。 EmbeddingGemma 2的核心设计逻辑是在有限硬件资源下实现高质量多模态推理。模型采用模块化架构,纯文本工作负载仅需约2.7亿参数,视觉编码器(1.7亿参数)与音频编码器(3亿参数)可按需加载,全模态版本总参数量为7.4亿。 谷歌公布的测试数据显示,在经过量化处理后,该模型在Google Pixel 11 Pro上运行时,纯文本权重仅需约191MB活跃内存,全多模态模式所需内存约为567MB。对于内存受限的消费级设备而言,这一指标具有实际部署意义。 在存储效率层面,模型引入Matryoshka表示学习(MRL)技术,允许开发者将输出向量从768维动态截断至512、256或128维,最高可实现本地向量数据库6倍的存储压缩比。 EmbeddingGemma 2将上下文窗口扩展至8K token,是上一代4倍,可在本地硬件上直接处理最长约5.5分钟的音频、29张图像、58帧视频,或上述模态的交错组合输入。 这一能力使跨模态语义检索场景在端侧变得可行,例如通过语音备忘录定位特定视频片段,或基于文本查询检索多小时音频录音。 在代码检索能力上,模型在MTEB Code基准测试中从68.76分提升至78.68分,升幅达9.92分,适用于本地代码库索引、语义代码搜索及编程智能体检索等场景。 谷歌指出,本地生成嵌入有助于确保数据隐私、降低流水线延迟,并使跨模态搜索与检索功能在完全离线状态下运行。这一定位与当前部分企业和开发者对数据主权和隐私合规的关注相契合。

相关标签

免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:http://www.gxycedu.cn/te_inform?id=3nwltg-qka7d6

评论区

热门讨论 · 占位展示
说说你的看法…
发表评论
  • 用户
    读者3号
    把某个热点主题按时间线读完,轮廓清楚了,不再只会复读热词。图示和类比都挺到位,读完往往能记住核心观点,而不是只剩“好神奇”。广告若有也相对克制,注意力还能留给内容本身。科学叙述尽量接得住更多人的生活,而不是只写给同温层。小处想得细,耐看也耐用。
    20261007 · 来自移动端
  • 用户
    高泽
    本来只想给小孩找答案,结果自己先上瘾了,修补式学习居然可以这么体面。偶尔承认“目前还没有定论”,这种诚实比假装全知强太多。离线下载后没网也能看,自习室或地铁里不至于中断。思维工具型条目比冷知识更值钱,打开方式对了就有复利。小处想得细,耐看也耐用。
    2026-10-07 11:22:50
  • 用户
    热心网友
    错轨(N)作者_彭彭的小说,内容值得关注,期待后续更新。
    20261007

期待你的精彩发言。