Anthropic · Claude Fable 5 · 2026 年 6 月

Claude Fable 5 — 為超長週期的複雜自主任務而構建

  • 百萬級上下文
  • 超長單次輸出
  • 最長自主執行取向
  • 安全分類器回退
Claude Fable 5

Claude Fable 5 是什麼?

Claude Fable 5 是 Anthropic 在 2026 年 6 月釋出的 Mythos 級公眾版本。它面向數小時乃至更長週期的自主知識工作與編程:官方稱能力超過此前任何公開發布的 Claude。部分與網路安全、生物化學或蒸餾相關的請求,可能由安全分類器改交 Claude Opus 4.8 回答,並告知使用者;多數會話仍全程由 Fable 5 處理。日常工程主力更常選 Claude Opus 5。在 iMini Agent 裡選 Claude Fable 5 即可使用。

廠商
Anthropic
釋出
2026 年 6 月
上下文
1M tokens
最大輸出
128K tokens
深度思考
高難度可加深
適合作為
極長、極難自主任務

相對 Claude Opus 4.8,升級了什麼

自主時長、跨域上限與長上下文專注——決定是否上 Fable 前最該看清的變化。

更長的自主執行

官方強調迄今 Claude 中最長的自主工作取向;任務越複雜、鏈路越長,相對 Opus 4.8 的優勢通常越明顯。

跨域頂格能力

軟體工程、知識工作、視覺與科研等官方測試基準全面抬升,適合單次投入高、可非同步等待的任務。

長上下文更專注

百萬級材料與長執行緒裡更容易保持目標;持久檔案記憶一類能力對長任務表現有幫助。

同等質量下更省步驟

官方客戶反饋與編程評測顯示,達到相近質量時常需要更少輪次與步驟,適合重負載非同步作業。

官方評測與安全審計

Anthropic 在 Claude Fable 5 / Mythos 5 釋出文中公佈的評測結果。兩個模型多數基準分差在 1–3 個百分點內,表格取兩者較高分;帶星號的網路安全與生物類基準因安全攔截,Fable 5 表現更接近 Claude Opus 4.8。

Claude Fable 5 / Mythos 5 與 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 的評測對照表
多工總覽。SWE-Bench Pro 80.3%、Terminal-Bench 2.1 88.0%、GDPval-AA 1932、OSWorld-Verified 85.0%,全面高於 Claude Opus 4.8、GPT-5.5 與 Gemini 3.1 Pro。注意表下方法說明:Fable 5 與 Mythos 5 多數分差在 1–3 個百分點內,此表取較高分。
Agent 編程評測:SWE-Bench Pro 與 FrontierCode 對照
Agent 編程兩項:SWE-Bench Pro 80.3%,比 Claude Opus 4.8(69.2%)高約 11 個百分點;FrontierCode 29.3%,是 Opus 4.8(13.4%)的兩倍多。FrontierCode 由真實前沿工程任務構成,更能說明長程編程與工具協作能力。
病毒衣殼實驗性質預測:無監督 AAV 包裝分類
病毒衣殼實驗性質預測(無監督 AAV 包裝分類,僅靠推理)。Claude Mythos 5 中位數約 0.85,明顯高於蛋白質語言模型基線 0.70,也高於 Claude Opus 4.8;用來說明在缺少標註模板的科學推理任務上仍能穩定推演。
網路對抗魯棒性評測:進攻性任務在紅隊攻擊下的完成率
網路對抗魯棒性:在自動化紅隊下,模型被誘使完成進攻性網路任務的成功率越低越好。Claude Fable 5 為 5.4%,遠低於 Claude Opus 4.8 的 56.6%——這是 Fable 5「可部署」定位的關鍵安全證據。
進攻性網路評測:Firefox、OSS-Fuzz、CyberGym、CyScenarioBench
進攻性網路四項基準。Claude Fable 在 Firefox、OSS-Fuzz、CyberGym、CyScenarioBench 上均為 0.0%;同屏的 Claude Mythos 5 則明顯更高。Anthropic 用這對對照說明:Fable 5 保留了高能力,但把攻擊性網路能力壓到接近零。
行為對齊審計:Claude Mythos 5 不對齊行為分數
行為對齊審計分數越低越好。Claude Mythos 5 為 2.06,接近 Claude Opus 4.8 的 2.05,明顯低於 Claude Sonnet 4.6 的 2.81;與能力分數一併看,才能判斷是否適合放進生產主力。

三種常見用法

Claude Fable 5 更適合失敗代價高、可非同步等待、鏈路很長的工作。

超長編程與倉庫級改造

用於跨大量檔案的遷移、重構與多日級修復。適合事先寫清成功標準,並接受更長的執行時間。

深度知識工作與科研整理

用於長材料推理、圖表閱讀與多源結論彙總。重點在可核對依據與可交付結論。

視覺驅動的重建與分析

用於根據截圖理解介面、重建頁面結構或閱讀科學圖表。適合把影像與長說明放在同一條執行緒裡推進。

和 Claude Opus 5、Claude Sonnet 5 怎麼選

三款都是當代 Claude。差別主要在頂格能力、日常主力成本,以及安全回退體驗。

對比項Claude Fable 5Claude Opus 5Claude Sonnet 5
上下文1M tokens1M tokens1M tokens
推理方式高難度可加深,頂格取向自帶深度思考,可調深度檔位可調
編程與 Agent極長、極難自主編程長程編程日常旗艦主力規模化 Agent 與日常編程
長程工具協作最長自主執行取向目標保持更好,完成度更高高頻主力更合適
速度取向更看重頂格完成質量質量與穩定性均衡更看重吞吐
更適合優先選用單次極長、極難、可非同步的任務新增長程編程與知識工作新增高頻 Agent 主力

在 iMini 上使用 Claude Fable 5

關於免費額度、安全回退、主要規格,以及和 Opus、Sonnet 怎麼區分。

在 iMini Agent 免費使用 Claude Fable 5

百萬級上下文,適合極長自主編程與知識工作。

開啟 Claude Fable 5

無需 Anthropic API Key。