Google DeepMind CEO:Gemma 4将在各参数规模上提供当前最强开源模型
Google DeepMind首席执行官Demis Hassabis在社交平台宣布推出新一代开源模型家族Gemma 4,称其为“在各自参数规模上全球最强的开源模型”,共包含四个规格:31B致密模型侧重高性能推理,26B Mixture of Experts模型优化低延迟吞吐,2B与4B有效参数模型则面向手机与本地设备部署。 根据Google官方博客与模型卡说明,Gemma 4全系采用Apache 2.0许可开源权重,支持多模态输入(文本+图像,小模型还支持音频),提供最长至256K的上下文窗口,并在Arena AI排行榜上以31B与26B版本分别取得开源模型第3与第6名的成绩。
多家技术媒体指出,Gemma 4的核心卖点是“intelligence-per-parameter”(单位参数智能密度):31B与26B模型在推理、代码与代理型任务上,表现可匹敌甚至超越参数量大二十倍以上的闭源模型,却可以在单张80GB GPU或高端工作站上本地运行,大幅降低企业与开发者的算力门槛。 小型E2B与E4B模型则针对Android、笔记本GPU与浏览器环境做了深度优化,提供长上下文、本地代码生成与多模态理解,被NVIDIA等生态伙伴视为“将高级AI从云端拉到边缘设备”的关键组件。
来源:公开信息
ABAB AI Insight
Gemma 4的发布,本质上是Google在“开源战线”对抗Llama、Mistral与其他社区模型的战略升级。通过在4个参数档位上同时追求高密度性能与单机可部署性,Google试图重新定义“主流开源模型”的标准——不是最大参数量,而是在给定硬件预算下的推理与代理综合能力,从而把争夺焦点从“云上算力”转向“工作站与终端上的AI生产力”。
从全球技术与资本结构看,Gemma 4采用Apache 2.0完全商用友好许可,是一个关键信号:Google愿意放弃对模型使用方式的强控制,以换取生态规模与开发者锁定。这与部分“伪开源”(带有强使用限制与复制限制)的路线形成对照,意味着大厂开始承认:在企业市场,真正没有附加条件的开源条款本身就是竞争武器,而不是慈善姿态——谁提供更干净的许可,谁就更容易成为行业默认标准。
在更长的产业周期里,Gemma 4所强调的“edge + workstation + agents”组合,也揭示了AI应用的迁移方向:从云端聊天机器人转向“本地运行的多模态代理”。小模型负责在手机、浏览器与PC端进行本地推理与长上下文管理,大模型则在单机或轻量服务器上承担复杂推理与代码生成,这种分层将逐步削弱对超大、超贵云模型的刚性依赖,重构算力租赁、API计费与应用分发的利润结构。某种意义上,Hassabis此时推出Gemma 4,不只是技术发布,更是对未来“三层结构”的宣告:开源模型做底层,终端设备做执行面,企业与开发者在其上构建真正可控的智能资产,而不是完全寄生在闭源云端。