可持续推进更久
官方称单任务最长约数小时连续工作,适合仓库级改造,中途少停住。
GLM 5.1 是智谱在 2026 年 4 月发布的型号,官方强调可连续推进数小时的编程与终端工具任务,中途少停住。相对 GLM-5,在 SWE 与终端评测上显著抬升。需要百万级上下文时,优先评估 GLM 5.2。在 iMini Agent 里选 GLM 5.1 即可使用。
可持续推进时长与工程评测——继续用 5.1 前最该看清的能力。
官方称单任务最长约数小时连续工作,适合仓库级改造,中途少停住。
在 SWE-Bench Pro、Terminal-Bench 等官方主推评测上相对前代更强。
开放权重,并兼容常见编码工具链,便于迁移评估。
工作流已在 5.1 验证时不必强迁;新开百万级任务再看 5.2。
智谱公布的 GLM-5.1 编程评测,综合 SWE-Bench Pro、Terminal-Bench 2.0 与 NL2Repo。

GLM 5.1 仍适合已验证的长时间编程与终端工具工作流。
用于长时间重构与修复。需要百万级上下文时可对照 5.2。
用于命令行多步任务。重点在成功标准。
用于中英混合的规格与代码评审。
三款都偏中文工程场景。差别主要在上下文长度与代际能力。
| 对比项 | GLM 5.1 | GLM 5.2 | Qwen3.6 Plus |
|---|---|---|---|
| 上下文 | 约 200K | 1M tokens | 1M tokens |
| 推理方式 | 适合长时间推进 | High / Max 可调 | 编码与工具取向 |
| 编程与工具 | 长时间编程与终端任务 | 百万上下文长任务编程 | 多模态仓库级编程 |
| 长程工具协作 | 可持续推进数小时 | 长线程交付 | 内置工具 + 视频 |
| 速度取向 | 长跑更重 | 可调思考预算 | 工作流取向 |
| 更适合优先选用 | 工作流仍锁在 5.1 时 | 需要百万级上下文时 | 绑定通义多模态时 |
关于免费额度、型号选择、主要规格,以及和 5.2 怎么区分。