谷歌发布Gemma 4 12B
Gemma 是谷歌主打的开源大模型系列.
之前大家常跑的是 7B, 9B 甚至 27B 的量级.
今天官方又扔出个 Gemma 4 12B 出来, 架构改得极其激进
— 强行扒掉视觉外衣.
以前在本地跑多模态, 显存一大半都被额外的视觉编码器吃掉了. 谷歌这次直接在底层动刀, 把庞大的编码器扔了, 换了个仅有 35M 参数的小模块, 把空间信息直接注入 token, 实现了视觉和文本的原生统一.
— 越级智力与物理显存.
因为砍了冗余架构, 官方宣称它能发挥出逼近 26B 大模型的推理能力, 但只需 16GB 显存或 Mac 统一内存就能满血跑.
— 老朋友光速发包.
咱们专门搞开源模型量化的老朋友 Unsloth 动作极快. 嗯, 官方前脚刚发, 他们就已经把高度压缩的 GGUF 格式打包好了.
用上量化权重, 估计 8G 到 12G 显存的普通打工人电脑也能流畅跑通.
本地笔记本可以试一试,它的GGUF表现怎么样
🔗 Blog: blog.google/innovation-and-ai/technology/developers-tools/introducing-gemma-4-12B/
🔗 GGUF: huggingface.co/unsloth/gemma-4-12b-it-GGUF
#Google #Gemma4 #开源模型 #多模态 #本地部署 #Unsloth
发布于 四川
