谷歌推出多模态嵌入模型 EmbeddingGemma 2,端侧运行内存低至 191MB
20 小时前

谷歌近日推出了EmbeddingGemma 2模型,该模型基于Gemma 4架构开发,并采用Apache 2.0许可协议发布。EmbeddingGemma 2拥有7.4亿总参数,基于Gemini嵌入模型的同源技术,能将文本、代码、图像、视频和音频等多种数据类型统一映射到同一嵌入空间。在子1B参数的多模态嵌入模型中,EmbeddingGemma 2性能领先。它采用模块化设计,支持动态截断输出向量维度,在端侧运行时内存占用低。此外,该模型还配备了8K Token的上下文窗口,代码性能较前代有显著提升,在多模态任务中表现优异。EmbeddingGemma 2注重数据隐私保护,能降低管线延迟,支持搭建完全离线的跨模态搜索和检索系统。当与同源的Gemma 4等生成模型搭配使用时,可实现低内存占用的端侧多模态RAG管线。该模型支持多平台和多类常用开发工具,开发者可在Hugging Face和Kaggle上下载模型权重,后续还将登陆Gemini Enterprise Agent Platform Model Garden。