智譜 · GLM 5.1 · 2026 年 4 月

GLM 5.1 — 面向數小時級持續任務的編程模型

  • 約 200K 上下文
  • 超長單次輸出
  • 適合長時間推進
  • 開源權重可對照
GLM 5.1

GLM 5.1 是什麼?

GLM 5.1 是智譜在 2026 年 4 月釋出的型號,官方強調可連續推進數小時的編程與終端工具任務,中途少停住。相對 GLM-5,在 SWE 與終端評測上顯著抬升。需要百萬級上下文時,優先評估 GLM 5.2。在 iMini Agent 裡選 GLM 5.1 即可使用。

廠商
智譜
釋出
2026 年 4 月
上下文
約 200K tokens
最大輸出
128K tokens
深度思考
適合長時間推進
更適合
已驗證的長時間編程工作流

相對 GLM-5,升級了什麼

可持續推進時長與工程評測——繼續用 5.1 前最該看清的能力。

可持續推進更久

官方稱單任務最長約數小時連續工作,適合倉庫級改造,中途少停住。

工程評測抬升

在 SWE-Bench Pro、Terminal-Bench 等官方主推評測上相對前代更強。

開源與工具鏈相容

開放權重,併兼容常見編碼工具鏈,便於遷移評估。

仍可穩定沿用

工作流已在 5.1 驗證時不必強遷;新開百萬級任務再看 5.2。

官方評測

智譜公佈的 GLM-5.1 編程評測,綜合 SWE-Bench Pro、Terminal-Bench 2.0 與 NL2Repo。

GLM-5.1 編程綜合評測對照
編程綜合分 54.9,高於 Gemini 3.1 Pro、Qwen3.6-Plus、MiniMax M2.7 與 Kimi K2.5,低於 GPT-5.4(58.0)與 Claude Opus 4.6(57.5)。三項基準合併後的位置一目瞭然。

三種常見用法

GLM 5.1 仍適合已驗證的長時間編程與終端工具工作流。

長時間編程

用於長時間重構與修復。需要百萬級上下文時可對照 5.2。

終端工具任務

用於命令列多步任務。重點在成功標準。

雙語工程協作

用於中英混合的規格與程式碼評審。

和 GLM 5.2、Qwen3.6 Plus 怎麼選

三款都偏中文工程場景。差別主要在上下文長度與代際能力。

對比項GLM 5.1GLM 5.2Qwen3.6 Plus
上下文約 200K1M tokens1M tokens
推理方式適合長時間推進High / Max 可調編碼與工具取向
編程與工具長時間編程與終端任務百萬上下文長任務編程多模態倉庫級編程
長程工具協作可持續推進數小時長執行緒交付內建工具 + 影片
速度取向長跑更重可調思考預算工作流取向
更適合優先選用工作流仍鎖在 5.1 時需要百萬級上下文時繫結通義多模態時

在 iMini 上使用 GLM 5.1

關於免費額度、型號選擇、主要規格,以及和 5.2 怎麼區分。

在 iMini Agent 免費使用 GLM 5.1

適合可持續推進數小時的編程與終端工具任務。

開啟 GLM 5.1

無需智譜 API Key。