通义千问 · Qwen3.7 Max · 2026 年 5 月

Qwen3.7 Max — 通义千问系列的旗舰模型

  • 百万级上下文
  • 最大输出 65K
  • 混合思考可开关
  • 工具与结构化输出
Qwen3.7 Max

Qwen3.7 Max 是什么?

Qwen3.7 Max 是阿里云通义千问在 2026 年 5 月前后推出的 Qwen3.7 文本旗舰,面向 Agent、编码、办公与复杂推理。相对 Qwen3.6 Max / 更早的 Max,上下文升到百万级,并强调混合思考与工具调用。需要视觉输入时看 Qwen3.7 Plus。在 iMini Agent 里选 Qwen3.7 Max 即可使用。

厂商
通义千问
发布
2026 年 5 月
上下文
1M tokens
最大输出
65K tokens
深度思考
混合思考 · 可开关
适合作为
通义峰值推理主力

相对 Qwen3.6 Max,升级了什么

上下文、混合思考与 Agent 工具面——当作 Max 主力前最该看清的变化。

上下文升到百万级

相对 3.6 常见的 256K 档,长规格与大仓库可以留在同一条线程里。

混合思考可开关

可开启思考;简单任务可关闭以换速度,困难任务保持深度。

工具与结构化输出更完整

函数调用、内置工具与结构化输出适合接到业务系统与 Agent 流程。

Agent 向评测主推

官方在 Terminal-Bench、SWE 等 Agent 向评测上重点展示,适合编码与自动化主力。

官方评测

Qwen 团队在《Qwen3.7: The Agent Frontier》公布的官方评测图。

Qwen3.7-Max 综合评测记分板:编程 Agent、通用 Agent、推理与多语能力
综合记分板。覆盖编程 Agent(SWE-Pro、Terminal Bench 等)、通用 Agent(MCP-Mark、MCP-Atlas、SkillsBench)、推理(GPQA、HLE、HMMT)与指令/多语;同屏对照 Opus、DeepSeek V4 Pro、GLM 等。用来判断 Max 在 Agent 场景的整体位置。
Qwen3.7-Max Agent 环境扩展轨迹与排名变化
Agent 环境扩展轨迹。展示随训练环境质量与多样性提升,平均排名向 Claude Opus 4.6 Max 靠近;用来理解「环境扩展」对 Agent 能力的贡献,而不是单次刷榜。
Qwen3.7-Max 跨 harness 泛化评测
跨 harness 泛化。同一模型在 Claude Code、OpenClaw、Qwen Code 等不同脚手架上的表现;看它是否只适配单一框架,还是能跨脚手架稳住。
Qwen3.7-Max 长程训练中的 reward hacking 自监控
长程 RL 中的 reward hacking 自监控。展示模型在 SWE 强化学习里发现并标记刷分行为;侧写长程训练稳定性,不是日常问答分数。

三种常见用法

Qwen3.7 Max 更适合需要峰值文本推理的通义任务。

复杂编码与 Agent

用于多步编程与工具编排。适合作为通义文本旗舰。

办公与决策材料

用于长文档整理、表格推理与一页备忘。

硬约束推理

用于带明确规则与数字的推导。重点在步骤可核对。

和 Qwen3.7 Plus、DeepSeek V4 Pro 怎么选

三款都偏峰值或旗舰。差别主要在视觉、产品栈与开源路线。

对比项Qwen3.7 MaxQwen3.7 PlusDeepSeek V4 Pro
上下文1M tokens1M tokens1M tokens
推理方式混合思考 · 峰值混合思考 · 均衡Think 高 / Max
编程与 Agent通义文本旗舰带视觉的均衡选型开源复杂编程旗舰
长程工具协作工具与结构化输出内置工具 + 图像长程自动化取向
速度取向更看重峰值质量性能与成本更均衡更看重完成质量
更适合优先选用通义峰值文本推理通义日常多模态主力DeepSeek 代码与硬推理

在 iMini 上使用 Qwen3.7 Max

关于免费额度、型号选择、主要规格,以及和 Plus 怎么区分。

在 iMini Agent 免费使用 Qwen3.7 Max

百万级上下文,混合思考,适合峰值推理与 Agent。

打开 Qwen3.7 Max

无需通义 API Key。