OpenAI · GPT-5.5 · 2026年4月

GPT-5.5 — プログラミング・分析・ツール呼び出しを兼ねる汎用フラッグシップ

  • 100万トークン級コンテキスト
  • 超長の単回出力
  • 深度帯を調整可
  • Agent プログラミングの主力世代
GPT-5.5

GPT-5.5 とは?

GPT-5.5 は、OpenAI が 2026年4月に出したフラッグシップで、複雑な専門業務を想定しています。Agent プログラミング、PC 操作、知識業務、初期の研究などです。GPT-5.4 と比べ、公式はより強い Agent 能力と、より少ないトークン消費を強調しています。GPT-5.6 以降は、最重タスクは Sol、日常のバランスは Terra と対照できます。すでに GPT-5.5 で安定しているワークフローは、引き続き主力にできます。iMini Agent で GPT-5.5 を選べば利用できます。

提供元
OpenAI
リリース
2026年4月
コンテキスト
1M tokens
最大出力
128K tokens
深い推論
帯を調整可
向いている役割
検証済みワークフローのフラッグシップ主力

GPT-5.4 と比べて何が変わったか

Agent プログラミング、同レイテンシでの知性、知識業務 — 5.4 から 5.5 へ移る前に押さえる変化です。

Agent プログラミングがより強い

公式は Terminal-Bench などの Agent プログラミング評価でより高い完了度を示し、多段階改修とツール連携に向きます。

同レイテンシでより高い知性

GPT-5.4 と比べ、公式は近いサービス遅延のままより強い知性を提供し、Codex 系タスクではより少ないトークンで仕事を終えると強調しています。

長コンテキストの専門業務がより安定

100万トークン級コンテキストで、長い仕様、複数ソース、ツール軌跡を同じスレッドで進められ、知識業務と複雑な納品に向きます。

研究とセキュリティ評価の段が上がった

GeneBench やサイバーセキュリティ関連評価で、公式は前世代からの段差改善を報告しています。GPT-5.6 へ移すかは照合のうえで決めてください。

公式評価

OpenAI が GPT-5.5 とともに公開した結果です。GPT-5.4 と同世代フラッグシップとの対照で、総合知性、ソフトウェア工学、知識業務、PC 操作、セキュリティ研究をカバーします。

Artificial Analysis Intelligence Index:総合知性の比較
第三者の総合知能指数。横軸は出力トークン総量。GPT-5.5 は全程で GPT-5.4、Claude Opus 4.7 の上にあり、同点到達に要する出力もより少ないです。世代を上げつつ、仕事をより抑えめで終えられます。
Terminal-Bench 2.0:コマンドラインのソフトウェア工学タスク
Terminal-Bench 2.0 はターミナル上の実ソフトウェア工学を測ります。GPT-5.5 のピークは約 83% で GPT-5.4 を明確に上回り、低出力帯でも 75% 超に届きます。多段階ターミナルタスクは深度を最大にしなくても安定しやすいです。
Expert-SWE:専門家級ソフトウェア工学タスク
Expert-SWE はシニアエンジニアが出題し、専門家級のソフトウェア工学能力を測ります。GPT-5.5 のピークは約 73% で、同じ出力量では GPT-5.4 より約 5 ポイント高く、大規模改修の手戻りが減ります。
GDPval:業界専門家との知識業務勝率
GDPval はモデル成果物と業界専門家の成果を盲検比較します。GPT-5.5 の勝+引は合計 84.9% で、GPT-5.4(83.0%)と Claude Opus 4.7(80.3%)を上回ります。レポートや表などの専門成果はすでに専門家基準の上にあります。
OSWorld-Verified:GUI での PC 操作
OSWorld-Verified は実 GUI でタスク完了を測ります。GPT-5.5 はより少ないツール呼び出しラウンドで約 80% に近づき、PC 操作系 Agent がより速く、より抑えめに走れます。
Tau2-bench Telecom:多ターン・ツール呼び出しのカスタマーフロー
Tau2-bench Telecom はツール呼び出し付きの多ターン業務を模擬します。GPT-5.5 の精度は約 98% に近く、出力は GPT-5.4 の約三分の一。業務自動化に載せる直接の根拠です。
GeneBench:生物学の推論
GeneBench は長時間の生物学推論を測ります。GPT-5.5 は 25% で、GPT-5.4 の 19% を一段上回り、必要な出力もより少なく、研究系の長推論で明確な利益があります。
Capture-the-Flags:セキュリティ攻防チャレンジ
CTF はエンドツーエンドのセキュリティ研究能力を測ります。GPT-5.5 は約 5 万出力トークンで 88% に達し、GPT-5.4 は約 14 万で 84%。OpenAI が最強の安全防護を有効にする理由の一つでもあります。

よくある三つの使い方

GPT-5.5 は検証済みの複雑な専門業務に引き続き向き、新規の最重負荷は GPT-5.6 と対照できます。

Agent プログラミングとリポジトリ改造

多段階改修、テスト修復、ファイル横断の機能向け。プロンプトと評価セットがすでに GPT-5.5 に結びついているチームの継続利用に向きます。

知識業務と意思決定メモ

調査の整理、表処理、一枚の意思決定メモ向け。硬い制約を引用し、照合できる推奨を出すことが要点です。

ツールと PC 操作のフロー

ツールを連続呼び出し、端から端まで走らせるワークフロー向け。成功基準と中止条件を先に決めてください。

GPT-5.6 Sol と GPT-5.6 Terra との選び方

三帯とも OpenAI の主力です。違いは世代の深度、日常コスト、ワークフローがすでに検証済みかどうかです。

比較項目GPT-5.5GPT-5.6 SolGPT-5.6 Terra
コンテキスト1M tokens1M tokens1M tokens
推論深度帯を調整可最大深度 · ultra 利用可バランス深度
プログラミング / Agentフラッグシップのプログラミングと Agent同世代で最重の長時間改修日常改修と中程度の Agent
長時間のツール実行検証済みワークフローは継続可フラッグシップ深度 + ultra完了度とスループットのバランス
速度の姿勢専門業務の主力完了品質と深さを優先日常主力はよりバランス
優先して選ぶ場面ワークフローがすでに 5.5 で通っているとき新規の最重推論と長時間タスク5.5 に近い能力で 5.6 バランス帯へ移したいとき

iMini で GPT-5.5 を使う

無料枠、モデル名、主な仕様、および GPT-5.6 との違い。

iMini Agent で GPT-5.5 を無料利用

100万トークン級コンテキスト、深度帯を調整可、検証済みの専門ワークフロー向き。

GPT-5.5 を開く

OpenAI API Key は不要です。