Qwen3.7-Plus:多模态智能体
DISCORD 今天,我们正式发布 Qwen3.7-Plus ——将视觉与语言统一为一体化智能体基座的多模态模型。在 Qwen3.7 强大文本能力的基础上,Qwen3.7-Plus 全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。 Qwen3.7-Plus 的核心特色在于其作为 多模态交互混合智能体 的能力。它能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用,以及基于网络知识回答视觉问题——在单一智能体循环中无缝融合 GUI 与 CLI 交互。作为全能型编码智能体与生产力助手,它以全模态输入处理从前端原型到复杂软件工程、再到多步工作流自动化的全方位任务。它具备跨框架泛化能力,无论通过 Claude Code、OpenClaw、Qwen Code 还是其他框架部署,均能保持稳定表现。 Qwen3.7-Plus — 现已通过 阿里云百炼 提供服务: Multimodal Agent: 统一处理图像、视频、屏幕、网页和文本输入,并在 GUI / CLI / 工具环境中完成任务 Visual Agent: 结合视觉理