OpenAI · GPT-5.6 Terra · 2026 年 7 月

GPT-5.6 Terra — 能力接近 GPT-5.5 的高效率主力模型

  • 百万级上下文
  • 超长单次输出
  • 接近 GPT-5.5 能力
  • 吞吐与深度更均衡
GPT-5.6 Terra

GPT-5.6 Terra 是什么?

GPT-5.6 Terra 是 OpenAI 在 2026 年 7 月推出的 GPT-5.6 均衡型号。它面向日常编程、推理与 Agent:官方称性能可与 GPT-5.5 竞争,同时落在 Sol 与 Luna 之间的成本与吞吐位置。最重、最长程的任务仍交给 Sol;高周转草稿与短轮自动化更适合 Luna。在 iMini Agent 里选 GPT-5.6 Terra 即可使用。

厂商
OpenAI
发布
2026 年 7 月
上下文
1M tokens
最大输出
128K tokens
深度推理
可调 · 均衡取向
适合作为
OpenAI 栈的日常主力

相对 GPT-5.5,升级了什么

同系列分工、日常主力成本,以及系列工具面——把 Terra 当作日常主力前最该看清的变化。

能力贴近 GPT-5.5

官方将 Terra 定位为与 GPT-5.5 性能竞争的日常模型,适合把大量原先打到单一旗舰的请求迁到更均衡的选择。

落在 Sol 与 Luna 之间

深度与成本介于 Sol 与 Luna 之间。新增工作可以先问:是否值得上 Sol,还是 Terra 已够稳。

长上下文仍按百万级配置

上下文与输出上限与同系列旗舰同档配置,长规格、多轮历史与工具轨迹可以留在同一条对话里推进。

接入 GPT-5.6 系列能力

与同代共享 reasoning、工具调用与多代理相关能力面,便于在 Agent 工作流里按任务重量在 Sol / Terra / Luna 之间切换。

官方评测

OpenAI 随 GPT-5.6 发布公布的评测结果,横轴统一为输出 token 量。Terra 的看点是:用明显更少的输出,拿到贴近 Sol 的分数。

Agents' Last Exam:长时程专业工作流得分
覆盖 55 个行业长时程工作流。Terra 拿到 50.4,距离 Sol(53.6)只差 3.2 分,却大幅超过 Claude Fable 5(40.5)。大批量业务任务用 Terra,是这张图给出的直接结论。
Artificial Analysis Intelligence Index v4.1 综合智能指数
第三方综合智能指数。Terra 曲线与 GPT-5.5 相当甚至更高,而输出 token 更少——对已经在用 GPT-5.5 的团队来说,这是一次不牺牲质量的换代。
Artificial Analysis Coding Agent Index v1.1 编程智能体指数
第三方编程智能体指数。Terra 77.4 分,已经高于 Claude Fable 5 的 77.2,与 Sol(80)差距不大。编程类日常任务不必上 Sol。
Terminal-Bench 2.1:命令行软件工程任务
命令行软件工程评测。Terra 87.4% 超过 GPT-5.5 的最好成绩,也超过 Claude Fable 5(86%)。终端里多步执行的工程任务,Terra 是够用且省的选择。
BrowseComp:多步网页检索与求证
多步网页检索评测。Terra 与 Sol 的曲线相当接近,检索、求证、汇总类任务用 Terra 即可覆盖大多数场景。
OSWorld 2.0:图形界面电脑操作
OSWorld 2.0 测在真实图形界面里操作电脑完成任务。Terra 超过 Claude Opus 4.8 的同时,输出 token 少了 85%,桌面自动化任务的成本结构完全不同。
AutomationBench:端到端业务流程通过率
AutomationBench 测端到端业务工作流能否从头跑完。Terra 曲线稳定在 GPT-5.5 与 GPT-5.4 之上,多步骤的业务自动化可以直接换代。
GDPval-AA v2:真实知识工作 Elo
真实知识工作 Elo 对比。Terra 高于 GPT-5.5,且用更少输出达到,写报告、整理材料这类高频工作是 Terra 的主场。

三种常见用法

GPT-5.6 Terra 更适合作为日常主力,把最重的少数任务留给 Sol。

日常编程与代码评审

用于常规功能开发、PR 评审与测试修复。重点在稳定给出可核对的改动与验证建议,把真正难的长程改造再交给 Sol。

高量业务与文档分析

用于客服草稿、内部工具说明、合同与长文档摘要。适合吞吐高、但仍需要可靠推理的业务负载。

中等长度的 Agent 流程

用于多步工具调用、但仍在可控轮次内的自动化。适合事先约定完成标准,避免把所有请求都压到旗舰深度。

和 GPT-5.6 Sol、GPT-5.6 Luna 怎么选

同代三档。差别主要在深度上限、吞吐,以及任务失败代价。

对比项GPT-5.6 TerraGPT-5.6 SolGPT-5.6 Luna
上下文1M tokens1M tokens1M tokens
推理方式均衡深度最大深度 · 可开 ultra更轻、更快
编程与 Agent日常编程与中等 Agent最重长程编程与安全研究短轮自动化与草稿
长程工具协作完成度与吞吐更均衡旗舰深度 + ultra高周转、较短线程
速度取向日常主力更看重均衡更看重完成质量与深度更看重响应与成本
更适合优先选用新增日常编程与高量业务失败代价高的最重任务草稿、分类与短轮自动化

在 iMini 上使用 GPT-5.6 Terra

关于免费额度、型号选择、主要规格,以及和 Sol、Luna 怎么区分。

在 iMini Agent 免费使用 GPT-5.6 Terra

百万级上下文,接近旗舰能力,更适合日常主力。

打开 GPT-5.6 Terra

无需 OpenAI API Key。