谷歌EmbeddingGemma2开源:740M塞进手机,跨模态检索轻量跑

740M参数,能在手机笔记本上离线跑

谷歌10月8日发布 EmbeddingGemma2,这是其首个原生多模态开源嵌入模型,参数规模740M。与上一代单模态嵌入模型相比,新版将文字、代码、图片、视频、音频统一映射到同一语义空间,实现真正的跨模态检索。完整多模态模型内存占用不到600MB,可在手机、笔记本和浏览器中直接运行,全程不必把任何内容上传到云端——你的相册、录音、视频都留在本地被检索,隐私这道关天然就守住了。

上下文窗口扩至8K,覆盖100多种语言

上下文窗口从上一代的2K扩至8K,能吞下更长的材料再做匹配。语言覆盖拉至100多种,跨语种找东西不再是障碍。模块化设计让用不上的部分可以按需加载,索引体积也能压一压,省下的既是空间也是算力。谷歌宣称它在图像、视频和代码检索任务上,明显领先同量级开源对手。

本地隐私检索,AI重心从云端回撤

当一个多模态嵌入模型小到能揣进手机、又开源到谁都能改,AI检索的重心正在从”把数据交给云端”悄悄挪回”让能力待在设备里”。在本地相册里按语义翻照片、在长视频里定位片段、离线检索散落各处的文件——这些场景的隐私关天然就守住了。EmbeddingGemma2 开源,意味着任何开发者均可自由使用、修改和部署。

相关阅读:谷歌更新SynthID探测器:公开上线水印检测工具,任何人均可免费使用