通义实验室
26-06-02 02:56 微博认证:通义大模型官方微博

AI“实干家”来了!Qwen3.7-Plus发布:能看、能想、更能动手💥

作为一个多模态混合智能体,Qwen3.7-Plus不仅能看懂图形界面、文档、真实场景,还能直接上手操作,同时可以调用命令行、自主编写代码并验证结果。

1️⃣ 视觉Agent
结合视觉理解、代码解释器和搜索增强,解决视觉谜题、真实世界问答和复杂推理任务。

2️⃣视觉编程
除了能“看懂”视觉内容,Qwen3.7-Plus 还能将其直接“翻译”为可执行代码。
· 看图/视频直接生成可二次编辑的SVG矢量代码
· 基于参考图自动组织页面布局、编写前端代码、处理交互动效,从“一张图”到“可交互网页原型”

3️⃣浏览器智能助手
基于Qwen3.7-Plus打造的浏览器智能助手,已通过Qwen for Chrome插件上线。安装后在侧边栏对话并授权,即可开启Agent模式——它能感知网页内容、理解你的意图,自动执行点击、输入、跳转等操作,实现从页面感知到GUI自动化的完整闭环。

4️⃣真实世界推理
Qwen3.7-Plus 围绕多模态智能体核心需求进行系统性升级,能够覆盖真实场景、文档图表、OCR、视频和驾驶场景理解,稳定处理截图、票据、表格、报告和复杂 UI 页面。

🚀 快速体验
已在阿里云百炼平台上线,支持OpenAI兼容API与Anthropic协议。
也可通过Claude Code、OpenClaw或Qwen Code直接调用。
-API:http://t.cn/AXXy09wX
-Qwen Studio:http://t.cn/AXXy09wa
#通义实验室##Qwen#

发布于 浙江