核心内容摘要
新华社|谷歌发布EmbeddingGemma 2:7.4亿参数多模态嵌入模型,主打端侧隐私搜索语音支持后台播放,做家务时当播客听,吸收意外地高。很多生活现象背后的原理讲得清楚,不装腔作势,也不故意卖萌到尴尬。广告若有也相对克制,注意力还能留给内容本身。懂用户时间结构的编辑,用起来特别加分。把核心求知需求解决得很扎实。连续高强度翻看也不容易心累。
谷歌于周一推出EmbeddingGemma 2,这是其面向设备端部署的多模态嵌入模型新一代产品,可在本地硬件上统一处理文本、图像、音频与视频,主打数据隐私保护与离线推理能力,对移动端AI应用开发者具有直接吸引力。 谷歌表示,该模型在MTEB代码评测中较上一代提升9.92分,并在sub-1B规模多模态嵌入模型中取得领先基准成绩,部分指标甚至超越体量两倍以上的专项模型。 上一代产品EmbeddingGemma自发布以来已累计超过2000万次下载,此次升级将嵌入能力从纯文本扩展至多模态,有望进一步扩大谷歌在端侧AI基础设施领域的开发者生态优势。 EmbeddingGemma 2的核心设计逻辑是在有限硬件资源下实现高质量多模态推理。模型采用模块化架构,纯文本工作负载仅需约2.7亿参数,视觉编码器(1.7亿参数)与音频编码器(3亿参数)可按需加载,全模态版本总参数量为7.4亿。 谷歌公布的测试数据显示,在经过量化处理后,该模型在Google Pixel 11 Pro上运行时,纯文本权重仅需约191MB活跃内存,全多模态模式所需内存约为567MB。对于内存受限的消费级设备而言,这一指标具有实际部署意义。 在存储效率层面,模型引入Matryoshka表示学习(MRL)技术,允许开发者将输出向量从768维动态截断至512、256或128维,最高可实现本地向量数据库6倍的存储压缩比。 EmbeddingGemma 2将上下文窗口扩展至8K token,是上一代4倍,可在本地硬件上直接处理最长约5.5分钟的音频、29张图像、58帧视频,或上述模态的交错组合输入。 这一能力使跨模态语义检索场景在端侧变得可行,例如通过语音备忘录定位特定视频片段,或基于文本查询检索多小时音频录音。 在代码检索能力上,模型在MTEB Code基准测试中从68.76分提升至78.68分,升幅达9.92分,适用于本地代码库索引、语义代码搜索及编程智能体检索等场景。 谷歌指出,本地生成嵌入有助于确保数据隐私、降低流水线延迟,并使跨模态搜索与检索功能在完全离线状态下运行。这一定位与当前部分企业和开发者对数据主权和隐私合规的关注相契合。
📕作者: 牛广亮撰 · 更新于 2026-10-07 10:40:28
🔥《《深入治疗》BY雨山前百度》洛塞尔索社媒晒阿根廷队友合照:享受每一刻
🍌《(1V3)林妙妙陆骁笔趣阁百度网盘》“逻辑折叠”以及韬定律,是华为在芯片突围中找到的另一条道路。它提出以“时间(τ)缩微”替代“几何缩微”,作为半导体与电子系统演进的新指导原则,不再执着于把晶体管做得更小,而是通过“逻辑折叠”等创新技术,持续压缩信号在系统中的传播时延,同时不断提升晶体管的有效密度,从而维持半导体与电子系统的持续演进。易边再战,中国队带着48分巨大领先优势进入下半场比赛,中国队继续疯狂降维打击,第三节再度单节轰出35+得分,且限制马来西亚队连续三节单节不足10分。中国队第三节打出38-8净胜30分攻势,前三节比赛结束中国队98-20领先马来西亚队。
🍑爱情岛消息称希捷与东芝竞购TDK硬盘磁头业务,争夺AI存储供应链关键环节
🛏️砰砰砰砰免费完整版百度视频在线观看因此,在我看来,我们当前最核心的工作,就是要在我们队员内部重新找回那种热情——那种在过去几年里因为经历的种种变故而一度缺失的激情和欢愉。所以这绝对是主教练对我们的明确要求,而我们在最近这几场比赛当中也用实际行动证明了我们已经重新找回了这种热情。否则的话,面对像法国这样的强敌,你是不可能扳平比分的,更不可能在比赛的最后阶段依然能全力去为胜利而拼搏。
🔞《玉足导管素材百度改图》另一种,是改进自己寻找改进的方法。它开始调整实验怎么做、方案怎么选,让下一次研发更有效率。人类交给它的工作,由完成一道题,逐渐扩大到研究怎样才能更好地解题。
📸 记者 刘佩义 摄 · 更新于 2026-10-07 10:40:28