#HuggingFace##开源模型##本地智能体##Qwen#
【行业动态:Holo3.1推动本地计算机使用智能体提速】
Holo3.1发布,这是基于Qwen模型家族的计算机使用智能体系列,面向桌面、网页和移动环境。新模型提供0.8B、4B、9B和35B-A3B四种尺寸,并首次发布FP8、Q4 GGUF、NVFP4等量化检查点。在AndroidWorld基准测试中,35B-A3B得分从67%提升至79.3%;在DGX Spark上,NVFP4量化相比BF16实现1.74倍token吞吐提升,平均步骤时间从6.8秒缩短至3.3秒。
计算机使用智能体要真正进入日常工作,需要低延迟、低成本和足够稳定的本地执行能力。Holo3.1的重点放在多尺寸模型、量化部署和函数调用协议,说明开源生态正在围绕“可部署的智能体”加速成熟。对企业和个人开发者来说,本地模型方案能降低数据外流顾虑,也能让自动化任务在内网、桌面和移动环境中更自然地运行。
发布于 北京
