5月20日,在2026阿里云峰会上,阿里巴巴正式发布全新一代千问旗舰模型Qwen3.7-Max。在第三方机构Arena全球大模型盲测总榜中,Qwen3.7-Max超过Kimi-K2.6、DeepSeek-v4-pro、GLM-5.1,与GPT、Claude、Gemini最强模型接近,位列国产模型第一。
Qwen3.7-Max定位为“面向智能体时代的新一代旗舰模型”,其最突出的核心优势在于智能体能力的广度与深度。模型面向当下智能体(Agent)全新设计,实现了编程、推理等核心能力的持续突破,可全自主完成35小时的超长程智能体复杂任务。在一个全新的芯片平台上,Qwen3.7-Max通过自主编程和超1000次工具调用,实现了一个关键内核的自我进化,推理速度较原版本提升10倍。
在多项关键基准测试中,Qwen3.7-Max表现领先。编程智能体方面,在SWE-Pro、SWE-Multilingual、SciCode等基准上取得领先成绩;通用智能体方面,在MCP-Atlas、MCP-Mark等基准上超越GLM5.1、Kimi-K2.6等模型,创下国产新高;推理方面,在GPQADiamond、HLE等核心测评中超越Claude-Opus4.6及所有国产模型;指令遵循IFBench评测得分79.1分突破新高。
值得关注的是,阿里大模型研发节奏显著加速。近3个月内,千问旗舰大模型已稳定迭代了3.5、3.6、3.7三个版本,不断抬高国产模型的性能上限。在峰会现场,阿里云宣布面向Agentic时代全面升级,重磅发布全新的“芯-云-模型-推理”技术体系。
Qwen3.7-Max展现出跨多种智能体框架的泛化能力,在ClaudeCode、OpenClaw、QwenCode等框架下均能稳定发挥,有望成为各类智能体系统的可靠底座。通过MCP集成和多智能体协作,该模型在企业级办公场景中可实现工作流自动化,将原本需要专业团队耗时数周的复杂项目缩短至数小时内完成。
据了解,Qwen3.7-Max模型API即将上线阿里云百炼。同时,千问3.7系列还将推出Qwen3.7-Plus等不同版本模型,拥有极强的多模态推理、视觉理解能力,实现从编程智能体到视觉智能体的全覆盖,为下一代AI提供全能智能体新基座。