より長く継続推進できる
公式は単一タスクで最長おおよそ数時間の連続作業とし、リポジトリ規模の改造で途中停止が減ると述べています。
GLM 5.1 は、智譜が 2026年4月に出したモデルで、公式は数時間続く改修とターミナルツールタスクを途中で止まりにくく連続推進できると強調しています。GLM-5 と比べ、SWE とターミナル評価で明確に上がっています。100万トークン級コンテキストが必要なら、まず GLM 5.2 を評価してください。iMini Agent で GLM 5.1 を選べば利用できます。
継続推進の長さと工学評価 — 5.1 を続ける前に押さえる能力です。
公式は単一タスクで最長おおよそ数時間の連続作業とし、リポジトリ規模の改造で途中停止が減ると述べています。
SWE-Bench Pro、Terminal-Bench など公式が推す評価で前世代より強いです。
オープンウェイトで、一般的なコーディングツールチェーンとも互換し、移行評価がしやすいです。
ワークフローがすでに 5.1 で通っているなら無理に移す必要はなく、新規の 100万トークン級タスクは 5.2 を見てください。
智譜が公開した GLM-5.1 のプログラミング評価です。SWE-Bench Pro、Terminal-Bench 2.0、NL2Repo を総合しています。

GLM 5.1 は、検証済みの長時間改修とターミナルツールのワークフローに引き続き向きます。
長時間のリファクタと修復向け。100万トークン級コンテキストが必要なら 5.2 と対照してください。
コマンドラインの多段階タスク向け。成功基準が要点です。
日中英が混在する仕様とコードレビュー向け。
三帯とも中国語の工学場面寄りです。違いはコンテキスト長と世代能力です。
| 比較項目 | GLM 5.1 | GLM 5.2 | Qwen3.6 Plus |
|---|---|---|---|
| コンテキスト | 約 200K | 1M tokens | 1M tokens |
| 推論 | 長時間の推進に向く | High / Max を調整可 | コーディングとツール志向 |
| プログラミングとツール | 長時間改修とターミナルタスク | 100万コンテキストの長タスク改修 | マルチモーダルなリポジトリ規模改修 |
| 長時間のツール実行 | 数時間の継続推進 | 長いスレッドでの納品 | 内蔵ツール + 動画 |
| 速度の姿勢 | 長時間走破はより重い | 思考予算を調整可 | ワークフロー志向 |
| 優先して選ぶ場面 | ワークフローがまだ 5.1 に固定のとき | 100万トークン級コンテキストが必要なとき | 通義のマルチモーダルに縛られているとき |
無料枠、モデル名、主な仕様、および 5.2 との違い。