5月24日,谷歌DeepMind的奥马尔·桑塞维罗宣布:自4月2日在Apache 2.0许可下发布以来,Gemma 4的下载量已突破1.2亿次。他称这种可在设备上运行的AI技术趋势实在“疯狂”。这一数据也进一步印证了整个Gemma系列的强劲势头——各代模型的总下载量已累计超过4亿次,在Hugging Face平台上还有超过10万种社区衍生版本。Gemma 4共推出四个版本:E2B、E4B、参数量为260亿的混合专家模型以及参数量为310亿的密集型模型;其中最小的两个版本是与高通、联发科联合开发的,专为高效的设备端推理设计,在采用4位量化技术后仅需不到1.5GB的内存即可运行。
在这一里程碑达成的同期,谷歌工程师还进行了实地演示:他们将一款处于实验阶段的Gemma 4应用带到了没有手机信号和Wi-Fi的偏远地区,测试其在Pixel设备及原型显示眼镜上的离线视觉理解能力、基于手写输入的数学推理功能以及工具调用功能——整个过程完全无需向服务器发送任何请求。谷歌将E2B与E4B模型作为Gemini Nano 4的开发基础,后者将是今年晚些时候登陆各大旗舰机的安卓系统级设备端AI模型;目前Gemini Nano已在超过1.4亿台安卓设备上运行。凭借多模态架构、原生工具调用功能以及出色的离线处理能力,Gemma 4无疑将成为谷歌对抗苹果设备端智能技术体系的核心利器。