艾瑞网
26-06-10 10:16 微博认证:聚合互联网数据资讯,融合互联网行业资源的国内新经济门户。

#GoogleDeepMind##Gemma##开源模型##多模态#
【行业动态:Gemma 4 12B继续把本地多模态门槛往下压】
Google DeepMind发布Gemma 4 12B,主打统一的无编码器多模态架构,原生支持音频输入。官方给出的核心卖点很直接:它在不少基准上的效果接近26B级MoE模型,但内存占用不到后者一半,只需16GB显存或统一内存,就能在消费级笔记本上本地运行。模型还内置多token预测drafter,用来降低推理延迟,并继续采用Apache 2.0许可开放发布。Gemma系列累计下载量已经超过1.5亿次,这次12B版本明显是在把“能用的多模态”往更轻的部署条件上推。
这条更新的行业意义不只是又多了一个开源模型,而是中等体量的多模态能力正在从“云端专属”变成“本地可跑”的默认选项。对企业内部工具、教育设备、边缘端应用和机器人原型来说,16GB级别的运行门槛会明显降低试错成本。统一架构也意味着推理栈、适配链路和后续微调工作更容易做标准化,开源中端多模态市场接下来会更卷性能、部署成本和许可证友好度,而不只是拼榜单截图。

发布于 北京