Moonshot · Kimi K3 · 2026年7月

Kimi K3 — 100万トークン級コンテキストの長周期コーディング・フラッグシップ

  • 100万トークン級コンテキスト
  • ネイティブ視覚入力
  • 深い推論を標準搭載
  • 長時間 Agent 志向
Kimi K3

Kimi K3 とは?

Kimi K3 は、Moonshot(月之暗面)が 2026年7月に出したオープンな最前線フラッグシップで、長時間のコーディング、知識業務、Agent ワークフローを想定しています。Kimi K2.6 と比べコンテキストは 100万トークン級へ上がり、ネイティブ視覚と常に調整可能な深い推論を強調します。日常の高回転はより軽い同族と対照し、頂格のクローズド対照は Claude Opus 5 や GPT-5.6 Sol を見てください。iMini Agent で Kimi K3 を選べば利用できます。

提供元
Moonshot(月之暗面)
リリース
2026年7月
コンテキスト
1M tokens
最大出力
プラットフォーム上限に従う
深い推論
標準でオン · 調整可
向いている役割
日中英の長コンテキスト・フラッグシップ主力

Kimi K2.6 と比べて何が変わったか

コンテキスト、視覚、深い推論 — Kimi フラッグシップにする前に押さえる変化です。

コンテキストが 100万トークン級へ

K2.6 の約 256K と比べ、長い仕様と大きなリポジトリ材料を同じスレッドで進められます。

ネイティブ視覚入力

画像を推論過程に直接入れられ、スクリーンショット、図表、UI を交えた改修や分析に向きます。

深い推論を標準搭載

難しいタスクでは推論帯を上げられ、日常は低い帯で速度を取れます。

長時間 Agent 志向がより強い

コーディング、研究、多段階ツール連携向けで、目標を納品できる結果まで保てます。

公式評価

Moonshot が Kimi K3 技術ブログで公開した評価図です。対照モデルはすべて最高思考強度(max / xhigh)で評価しています。

Kimi K3 内部知識業務評価:Online Exp、DECK、Finance
内部知識業務三項目。Online Exp Bench 75.5、DECK-Bench 73.5、Finance-Bench 62.6 で、同画面の GPT-5.5 と Claude Opus 4.8 を上回ります。知識整理と金融材料は K3 の強みの一つです。
Kimi K3 の Agent / ツール使用関連評価
Agent とツール関連評価。多段階ツール呼び出し、閲覧、自動化を広げ、一回の Q&A だけでなく実ワークフローで完走できるかを見ます。
Kimi K3 の視覚と文書理解評価
視覚と文書理解。ネイティブ・マルチモーダル能力の対照です。画像・表・長文書の読解は、純テキスト点数と分けて見てください。
Kimi K3 の推論評価対照
推論系ベンチの対照。Claude Fable 5、GPT-5.6 Sol などと同画面。K3 はオープンウェイトでは前方ですが、最強クローズド数帯には明確に後れます。
Kimi K3 プログラミング評価:DeepSWE、FrontierSWE、Terminal Bench など
プログラミング六項目。DeepSWE 67.5、FrontierSWE 81.2、Terminal Bench 2.1 88.3、Program Bench 77.8、SWE Marathon 42.0。複数項目で Opus 4.8 を上回り、全体ではまだ Fable 5 / GPT-5.6 Sol の頂点帯より下です。
Kimi K3 の補足評価図
補足評価。主表と併せて読んでください。方法説明に harness と競合の取得元が書かれ、ベンダー横断比較は方法を基準にしてください。

よくある三つの使い方

Kimi K3 は、日中英環境での長い材料と長時間タスクに向きます。

長時間コーディング

ファイル横断の機能変更、テスト修復、リポジトリ規模の改造向け。より高い推論帯を開いてください。

画像付きの知識業務

スクリーンショットの読解、図表整理、意思決定メモ向け。見える根拠を引用することが要点です。

多段階 Agent

ツール呼び出しと研究型自動化向け。成功基準と中止条件を先に決めてください。

Kimi K2.6 と GLM 5.2 との選び方

三帯とも中国語とオープン寄りの路線です。違いはコンテキスト、視覚、フラッグシップ世代です。

比較項目Kimi K3Kimi K2.6GLM 5.2
コンテキスト1M tokens約 256K tokens1M tokens
推論深い推論を標準搭載 · 調整可マルチサブエージェント連携志向Thinking High / Max
プログラミング / Agent長時間コーディング・フラッグシップ長時間コーディングとマルチサブエージェント連携オープンな coding / agent フラッグシップ
長時間のツール実行視覚 + 長いスレッドマルチサブエージェント連携長時間納品志向
速度の姿勢帯を下げて速度を取れる長時間タスクはより重い思考予算を調整可
優先して選ぶ場面新規の Kimi フラッグシップタスクまだ K2.6 ワークフローに固定のとき智譜スタックに縛られているとき

iMini で Kimi K3 を使う

無料枠、モデル名、主な仕様、および K2.6・GLM との違い。

iMini Agent で Kimi K3 を無料利用

100万トークン級コンテキスト、ネイティブ視覚、長時間コーディングと知識業務向き。

Kimi K3 を開く

Moonshot API Key は不要です。