月之暗面 · Kimi K3 · 2026 年 7 月

Kimi K3 — 支援百萬級上下文的長週期編碼旗艦

  • 百萬級上下文
  • 原生視覺輸入
  • 自帶深度推理
  • 長程 Agent 取向
Kimi K3

Kimi K3 是什麼?

Kimi K3 是月之暗面在 2026 年 7 月釋出的開放前沿旗艦,面向長程編碼、知識工作與 Agent 工作流。相對 Kimi K2.6,上下文升到百萬級,並強調原生視覺與始終可調的深度推理。日常高週轉可對照更輕的同族型號;頂格閉源對照可看 Claude Opus 5 或 GPT-5.6 Sol。在 iMini Agent 裡選 Kimi K3 即可使用。

廠商
月之暗面
釋出
2026 年 7 月
上下文
1M tokens
最大輸出
按平臺上限
深度推理
自帶開啟 · 可調
適合作為
中英長上下文旗艦主力

相對 Kimi K2.6,升級了什麼

上下文、視覺與深度推理——設為 Kimi 旗艦前最該看清的變化。

上下文升到百萬級

相對 K2.6 的約 256K,長規格與大倉庫材料可以留在同一條執行緒裡推進。

原生視覺輸入

影像可直接進入推理過程,適合帶著截圖、圖表與介面一起編程或做分析。

自帶深度推理

困難任務可把推理檔位拉高;日常仍可選用較低檔換速度。

長程 Agent 取向更強

面向編碼、研究與多步工具協作,適合把目標保持到可交付結果。

官方評測

Moonshot 在 Kimi K3 技術部落格公佈的評測圖。所有對照模型均按最高思考強度(max / xhigh)評測。

Kimi K3 內部知識工作評測:Online Exp、DECK、Finance
內部知識工作三項。Online Exp Bench 75.5、DECK-Bench 73.5、Finance-Bench 62.6,均高於同屏的 GPT-5.5 與 Claude Opus 4.8——知識整理與金融材料是 K3 的強項之一。
Kimi K3 Agent / 工具使用相關評測
Agent 與工具相關評測。把多步工具呼叫、瀏覽與自動化任務攤開,用來判斷 K3 能否在真實工作流裡把任務跑完,而不只看單次問答。
Kimi K3 視覺與文件理解評測
視覺與文件理解。原生多模態能力的對照;讀圖、讀表、讀長文件時,和純文本分數要分開看。
Kimi K3 推理評測對照
推理類基準對照。與 Claude Fable 5、GPT-5.6 Sol 等同屏;K3 在開放權重裡靠前,但仍明確落後於最強閉源幾檔。
Kimi K3 編程評測:DeepSWE、FrontierSWE、Terminal Bench 等
編程六項。DeepSWE 67.5、FrontierSWE 81.2、Terminal Bench 2.1 88.3、Program Bench 77.8、SWE Marathon 42.0;多項高於 Opus 4.8,整體仍低於 Fable 5 / GPT-5.6 Sol 頂尖檔。
Kimi K3 補充評測圖
補充評測。與主表一併閱讀;方法說明裡會寫明 harness 與競品取數來源,跨廠商對比時以方法為準。

三種常見用法

Kimi K3 更適合中英環境下的長材料與長程任務。

長程編碼

用於跨檔案改功能、修測試與倉庫級改造。適合開啟更高推理檔位。

帶圖的知識工作

用於讀截圖、整理圖表與寫決策備忘。重點在引用可見依據。

多步 Agent

用於工具呼叫與研究型自動化。適合事先約定成功標準與中止條件。

和 Kimi K2.6、GLM 5.2 怎麼選

三款都偏中文與開源路線。差別主要在上下文、視覺與旗艦代際。

對比項Kimi K3Kimi K2.6GLM 5.2
上下文1M tokens約 256K tokens1M tokens
推理方式自帶深度 · 可調多子代理編排取向Thinking High / Max
編程與 Agent長程編碼旗艦長程編碼與多子代理編排開源 coding / agent 旗艦
長程工具協作視覺 + 長執行緒多子代理編排長程交付取向
速度取向可降檔換速度長跑任務更重可調思考預算
更適合優先選用新增 Kimi 旗艦任務仍繫結 K2.6 工作流時繫結智譜棧時

在 iMini 上使用 Kimi K3

關於免費額度、型號選擇、主要規格,以及和 K2.6、GLM 怎麼區分。

在 iMini Agent 免費使用 Kimi K3

百萬級上下文,原生視覺,適合長程編碼與知識工作。

開啟 Kimi K3

無需月之暗面 API Key。