Qwen3-Coder-Next 正式开源:推动小型混合模型在智能体编程上的边界
它来了,Qwen3-Coder-Next 带着 80B 总规模、仅 3B 激活参数的 MoE 架构走来了!
核心特点:
📌极高能效比:前向计算仅激活 3B 参数,推理成本极低,性能媲美参数量大 10-20 倍的模型。
📌智能体进化:我们不只依赖参数规模,更在扩展“智能体训练信号”。通过大规模可执行任务、环境反馈强化学习,克服了线性注意力的局限。
📌效率显著:在 SWE-Agent 框架下,SWE-Bench Verified 解决率突破 70%!
🚀 立即体验:
魔搭社区、Hugging Face、GitHub
#通义##Qwen# http://t.cn/AX5yIOHa
发布于 浙江
