Anthropic · Claude Fable 5 · 2026 年 6 月

Claude Fable 5 — 为超长周期的复杂自主任务而构建

  • 百万级上下文
  • 超长单次输出
  • 最长自主运行取向
  • 安全分类器回退
Claude Fable 5

Claude Fable 5 是什么?

Claude Fable 5 是 Anthropic 在 2026 年 6 月发布的 Mythos 级公众版本。它面向数小时乃至更长周期的自主知识工作与编程:官方称能力超过此前任何公开发布的 Claude。部分与网络安全、生物化学或蒸馏相关的请求,可能由安全分类器改交 Claude Opus 4.8 回答,并告知用户;多数会话仍全程由 Fable 5 处理。日常工程主力更常选 Claude Opus 5。在 iMini Agent 里选 Claude Fable 5 即可使用。

厂商
Anthropic
发布
2026 年 6 月
上下文
1M tokens
最大输出
128K tokens
深度思考
高难度可加深
适合作为
极长、极难自主任务

相对 Claude Opus 4.8,升级了什么

自主时长、跨域上限与长上下文专注——决定是否上 Fable 前最该看清的变化。

更长的自主运行

官方强调迄今 Claude 中最长的自主工作取向;任务越复杂、链路越长,相对 Opus 4.8 的优势通常越明显。

跨域顶格能力

软件工程、知识工作、视觉与科研等官方测试基准全面抬升,适合单次投入高、可异步等待的任务。

长上下文更专注

百万级材料与长线程里更容易保持目标;持久文件记忆一类能力对长任务表现有帮助。

同等质量下更省步骤

官方客户反馈与编程评测显示,达到相近质量时常需要更少轮次与步骤,适合重负载异步作业。

官方评测与安全审计

Anthropic 在 Claude Fable 5 / Mythos 5 发布文中公布的评测结果。两个模型多数基准分差在 1–3 个百分点内,表格取两者较高分;带星号的网络安全与生物类基准因安全拦截,Fable 5 表现更接近 Claude Opus 4.8。

Claude Fable 5 / Mythos 5 与 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 的评测对照表
多任务总览。SWE-Bench Pro 80.3%、Terminal-Bench 2.1 88.0%、GDPval-AA 1932、OSWorld-Verified 85.0%,全面高于 Claude Opus 4.8、GPT-5.5 与 Gemini 3.1 Pro。注意表下方法说明:Fable 5 与 Mythos 5 多数分差在 1–3 个百分点内,此表取较高分。
Agent 编程评测:SWE-Bench Pro 与 FrontierCode 对照
Agent 编程两项:SWE-Bench Pro 80.3%,比 Claude Opus 4.8(69.2%)高约 11 个百分点;FrontierCode 29.3%,是 Opus 4.8(13.4%)的两倍多。FrontierCode 由真实前沿工程任务构成,更能说明长程编程与工具协作能力。
病毒衣壳实验性质预测:无监督 AAV 包装分类
病毒衣壳实验性质预测(无监督 AAV 包装分类,仅靠推理)。Claude Mythos 5 中位数约 0.85,明显高于蛋白质语言模型基线 0.70,也高于 Claude Opus 4.8;用来说明在缺少标注模板的科学推理任务上仍能稳定推演。
网络对抗鲁棒性评测:进攻性任务在红队攻击下的完成率
网络对抗鲁棒性:在自动化红队下,模型被诱使完成进攻性网络任务的成功率越低越好。Claude Fable 5 为 5.4%,远低于 Claude Opus 4.8 的 56.6%——这是 Fable 5「可部署」定位的关键安全证据。
进攻性网络评测:Firefox、OSS-Fuzz、CyberGym、CyScenarioBench
进攻性网络四项基准。Claude Fable 在 Firefox、OSS-Fuzz、CyberGym、CyScenarioBench 上均为 0.0%;同屏的 Claude Mythos 5 则明显更高。Anthropic 用这对对照说明:Fable 5 保留了高能力,但把攻击性网络能力压到接近零。
行为对齐审计:Claude Mythos 5 不对齐行为分数
行为对齐审计分数越低越好。Claude Mythos 5 为 2.06,接近 Claude Opus 4.8 的 2.05,明显低于 Claude Sonnet 4.6 的 2.81;与能力分数一并看,才能判断是否适合放进生产主力。

三种常见用法

Claude Fable 5 更适合失败代价高、可异步等待、链路很长的工作。

超长编程与仓库级改造

用于跨大量文件的迁移、重构与多日级修复。适合事先写清成功标准,并接受更长的运行时间。

深度知识工作与科研整理

用于长材料推理、图表阅读与多源结论汇总。重点在可核对依据与可交付结论。

视觉驱动的重建与分析

用于根据截图理解界面、重建页面结构或阅读科学图表。适合把图像与长说明放在同一条线程里推进。

和 Claude Opus 5、Claude Sonnet 5 怎么选

三款都是当代 Claude。差别主要在顶格能力、日常主力成本,以及安全回退体验。

对比项Claude Fable 5Claude Opus 5Claude Sonnet 5
上下文1M tokens1M tokens1M tokens
推理方式高难度可加深,顶格取向自带深度思考,可调深度档位可调
编程与 Agent极长、极难自主编程长程编程日常旗舰主力规模化 Agent 与日常编程
长程工具协作最长自主运行取向目标保持更好,完成度更高高频主力更合适
速度取向更看重顶格完成质量质量与稳定性均衡更看重吞吐
更适合优先选用单次极长、极难、可异步的任务新增长程编程与知识工作新增高频 Agent 主力

在 iMini 上使用 Claude Fable 5

关于免费额度、安全回退、主要规格,以及和 Opus、Sonnet 怎么区分。

在 iMini Agent 免费使用 Claude Fable 5

百万级上下文,适合极长自主编程与知识工作。

打开 Claude Fable 5

无需 Anthropic API Key。