无影寺说
26-04-17 01:47

今天阿里开源了Qwen3.6-35B-A3B。

这个模型的总参数是35B,但跑起来实际激活的参数只有3B。这是什么概念?就是用极其省流的硬件资源,干了别人几十B甚至上百B模型才能干的活。

简单梳理一下它的几个硬核能力:
> 代码能力:在SWE-bench上得分73.4,不仅远超Gemma4-31B的52.0,甚至快追上自家的27B稠密模型了。
> 视觉表现很好:作为一个原生多模态模型,它在MMMU等好几个视觉榜单上的表现,居然匹敌甚至局部超越了闭源巨头Claude Sonnet 4.5。
> 本地部署很友好:发布第一天,UnslothAI就已经支持了动态GGUF格式,只要你有23GB内存就能在本地顺滑跑起来。

网上也有人吐槽说MoE路线走不远,稠密模型才是王道。但我个人觉得,对于普通开发者和中小团队来说,好用、能用、跑得起才是硬道理。当你能在本地用这么低的成本,调用这么强的多模态和代码代理能力时,路线之争就显得没那么重要了。

据说它对文言文的理解能力也很绝,配合文言文提示词能大幅省Token,钱包终于能喘口气了。

一句话总结:用3B的运算开销换来闭源前沿级别的视觉和代码能力,低成本本地部署的黄金时代来了。

发布于 广东