Google发表开源原生多模态嵌入模型EmbeddingGemma 2 与新一代Gemini 4 Argon

Google(GOOGL-US) 周二(7日)正式发表全新人工智慧模型,包含首款採用 Apache 2.0 授权条款的开源原生多模态嵌入模型 EmbeddingGemma 2,以及具备高达 100 万 Token 输出限制的旗舰级语言模型 Gemini 4 Argon。

Google 执行长 Sundar Pichai 表示,EmbeddingGemma 2 为 Google 第一个开放原始码且原生支援多模态的嵌入模型,机能将文字、程式码、图像、视讯与音讯统一定位在单一向量空间中,方便开发者于消费级装置上进行高效搜寻与检索。

EmbeddingGemma 2:轻量化架构与装置端运算

EmbeddingGemma 2 採用基于 Gemma 4 的模组化架构,总参数量为 7.4 亿(740M)。模型结构由 2.7 亿参数的纯文字主干、1.7 亿参数的视觉编码器,以及 3 亿参数的音讯编码器组成。在实际应用中,开发者可依据需求仅载入纯文字模态(270M)或结合视觉与音讯模态,弹性调配硬体资源。

‌

在装置端(On-device)执行效能方面,经量化处理后的 EmbeddingGemma 2 在 Google Pixel 11 Pro 上运作时,纯文字模式仅需约 191MB 的活跃记忆体,而完整多模态版本约需 567MB。此外,模型将上下文视窗扩展至 8,000(8K)Token,为前一代产品的 4 倍,单次可在本地端处理长达 5.5 分钟的音讯、29 张图像或 58 帧视讯。

为降低本地向量资料库的记忆体负担,EmbeddingGemma 2 导入了 Matryoshka 表示学习(MRL) 技术,允许将预设的 768 维输出向量弹性截取至 512、256 或 128 维,最高可节省 6 倍储存空间。在基準测试表现上,其于 MTEB Code 程式码检索测试中取得 78.68 分,相较前代的 68.76 分进步了 9.92 分,显着提升了本地程式码库索引与检索的效能。

开源权重三大优势:自主控制、隐私安全与高效运算

相较于闭源 API 服务,开放模型权重的首要优势在于避免供应商锁定与系统崩溃风险。若闭源服务调整策略或将模型下线,开发者存于向量资料库中的历史向量皆需重新计算;而开源权重下载至本地硬体后,开发者能享有完全的系统自主控制权。

其次,开放权重支援边缘装置(On-device)运作与高隐私防护。机密文件与多模态资料无需上传至云端伺服器,即可于本地直接生成嵌入向量,能显着降低资料传输延迟。经量化处理后,在智慧型手机(如 Pixel 11 Pro)上运作时,纯文字模式仅需约 191MB 活跃记忆体。

‌

最后,开放权重能无缝整合至社群生态系与开源工具链,并支援开发者针对特定领域进行客製化微调。

Gemini 4 Argon:百万Token 输出的旗舰模型

在发表 EmbeddingGemma 2 的同时,Google 推出了新一代旗舰模型 Gemini 4 Argon。该模型主打长工作流程(Long-horizon workflows),专为複杂软体工程、法律文件撰写、金融研究与网路安全防卫等任务打造。

Gemini 4 Argon 的最大技术特点在于将单次回应的输出上限大幅提升至 100 万(1M)Token,远高于先前机型的 64,000 Token,使其能在单一流程中完成深入推理与长篇程式码生成。

对于模型效能,Google DeepMind 资深副总裁 Koray Kavukcuoglu 将 Gemini 4 Argon 定位为前沿智慧新时代的开端。在 Google 公布的 18 项效能评测中,Gemini 4 Argon 在其中的 12 项测试中超越了 OpenAI 的 GPT-6 Astra 与 Anthropic 的 Claude Opus 5.5。

在发行策略上,Google 目前优先将 Gemini 4 Argon 提供给参与Fairwind 计画的全球 650 多家资安合作伙伴与政府防护机构使用。

定价方面,发表初期的促销价格为每百万输入 Token 2 美元、输出 Token 10 美元,未来将回升至 4 美元与 20 美元。至于一般 API 与 Google AI Ultra 订阅者的开放时间,官方表示将会在后续阶段陆续推动。

发布于 2026-10-07 13:46
收藏
1
上一篇:EmbeddingGemma 2登场!Google AI搜寻可离线跑 语音找影片 文字搜音讯 下一篇:通膨与地缘风险加剧 印度央行时隔近4年首度升息