740M参数,能在手机笔记本上离线跑
谷歌10月8日发布 EmbeddingGemma2,这是其首个原生多模态开源嵌入模型,参数规模740M。与上一代单模态嵌入模型相比,新版将文字、代码、图片、视频、音频统一映射到同一语义空间,实现真正的跨模态检索。完整多模态模型内存占用不到600MB,可在手机、笔记本和浏览器中直接运行,全程不必把任何内容上传到云端——你的相册、录音、视频都留在本地被检索,隐私这道关天然就守住了。
上下文窗口扩至8K,覆盖100多种语言
上下文窗口从上一代的2K扩至8K,能吞下更长的材料再做匹配。语言覆盖拉至100多种,跨语种找东西不再是障碍。模块化设计让用不上的部分可以按需加载,索引体积也能压一压,省下的既是空间也是算力。谷歌宣称它在图像、视频和代码检索任务上,明显领先同量级开源对手。
本地隐私检索,AI重心从云端回撤
当一个多模态嵌入模型小到能揣进手机、又开源到谁都能改,AI检索的重心正在从”把数据交给云端”悄悄挪回”让能力待在设备里”。在本地相册里按语义翻照片、在长视频里定位片段、离线检索散落各处的文件——这些场景的隐私关天然就守住了。EmbeddingGemma2 开源,意味着任何开发者均可自由使用、修改和部署。
相关阅读:谷歌更新SynthID探测器:公开上线水印检测工具,任何人均可免费使用
延伸阅读
- MiniMax Design 上线:H3 多模态模型驱动创作画布,覆盖电商广告等 8 类商业视频3 周前
- DreamRSI:Google用历史做梦降低探索调用,最高降162倍3 周前
- DeepSeek-V4-Flash-Vision-Exp 权重开源:168GB、MIT 协议,48 个 Safetensors 分片可私有化部署2 周前
- 智谱 GLM-5.3-Flash 夜间免费用:9月3日至20日每晚23点至次日9点全免1 月前
AI 自学笔记 每天更新 AI 前沿动态,订阅 RSS,或按 Ctrl/⌘+D 收藏本站,明天见。
