智谱 · GLM 5.2 · 2026 年 6 月

GLM 5.2 — 支持百万级上下文的长任务编程模型

  • 百万级上下文
  • 超长单次输出
  • Thinking 可调
  • 开源权重可对照
GLM 5.2

GLM 5.2 是什么?

GLM 5.2 是智谱在 2026 年 6 月发布的开源型号,适合在百万级上下文里推进长任务编程与终端工具协作。相对 GLM 5.1,上下文升到百万级,并强化长上下文效率与可调思考预算。需要视觉多模态时请选用对应视觉型号,本页按文本能力介绍。在 iMini Agent 里选 GLM 5.2 即可使用。

厂商
智谱
发布
2026 年 6 月
上下文
1M tokens
最大输出
128K tokens
深度思考
High / Max 可调
更适合
长任务编程与终端工具协作

相对 GLM 5.1,升级了什么

上下文、长线程效率与思考预算——继续用 5.2 前最该看清的变化。

上下文升到百万级

相对 5.1 的约 200K,长规格与大仓库可以留在同一条对话里。

长上下文更省算力

官方强调 IndexShare 等设计降低百万级上下文成本,适合稳定长跑。

Thinking 深度可调

困难任务可开 High / Max;简单任务可降低预算换速度。

开源 coding 表现抬升

在 Terminal-Bench、SWE-Bench Pro 等官方主推评测上相对前代更强,适合工程主力。

官方评测

智谱在 GLM-5 系列资源页公布的评测图,覆盖编程、长程任务与 Vending Bench。所有模型按最高思考强度评测。

GLM-5.2 与 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 的多任务评测
多任务评测。SWE-bench Pro 62.1%、Terminal-Bench 2.1 81.0%、MCP-Atlas 77.0%,多项接近 Claude Opus 4.8;DeepSWE 46.2% 仍低于 GPT-5.5。用来看 GLM-5.2 在编程与工具 Agent 上的整体位置。
GLM-5.2 长程任务评测
长程任务评测。把更长时间跨度的工程与 Agent 任务单独摊开,用来判断模型能否在多步骤、长仓库场景里稳住,而不只看短基准。
Vending Bench:GLM-5.2 评测
Vending Bench。面向真实经营/售卖类长程决策任务;和纯编程基准互补,用来观察模型在持续目标约束下的表现。

三种常见用法

GLM 5.2 更适合双语环境下的长任务编程与终端工具协作。

长程编程

用于跨文件功能、重构与测试修复。适合打开更高思考档位。

终端与工具协作

用于命令行环境与多步工具协作。重点在成功标准与中止条件。

中英知识工作

用于调研整理与决策备忘。适合国内交付与双语材料。

和 GLM 5.1、Claude Opus 4.8 怎么选

三款都偏长程工程。差别主要在代际、开源栈与 Claude 上限。

对比项GLM 5.2GLM 5.1Claude Opus 4.8
上下文1M tokens约 200K tokens1M tokens
推理方式High / Max 可调适合长时间推进通常高深度
编程与 Agent长任务编程与终端工具长任务工程Opus 编程协作
长程工具协作长线程交付数小时自主执行稳定 Opus 协作
速度取向可调思考预算长跑更重质量与体验均衡
更适合优先选用新增智谱长任务编程工作流仍锁在 5.1 时绑定 Claude 栈时

在 iMini 上使用 GLM 5.2

关于免费额度、型号选择、主要规格,以及和 5.1 怎么区分。

在 iMini Agent 免费使用 GLM 5.2

百万级上下文,Thinking 可调,适合长任务编程与工具协作。

打开 GLM 5.2

无需智谱 API Key。