2026 年 6 月 9 日,Anthropic 发布了 Claude Fable 5 和 Claude Mythos 5——同一个底座模型,两套安全策略。官方用了一个前所未有的级别定义:Mythos 级。
三天后,这个模型被美国政府以出口管制为由强制下线。关于封禁事件本身,本站已有详细报道。本文聚焦另一个问题:Fable 5 到底做了什么,让 Anthropic 敢称其为「有史以来最强模型」,又让开发者社区在它被禁后集体焦虑?
Fable 5 的核心突破不是某个 benchmark 数字,而是把「AI 自主完成长程复杂任务」从演示变成了生产级能力。
核心规格
以下数据全部来自 Anthropic 官方发布公告:
| 维度 | Claude Fable 5 |
|---|---|
| 发布日期 | 2026 年 6 月 9 日 |
| API 标识 | claude-fable-5 |
| 上下文窗口 | 1M tokens(~75 万英文单词) |
| 最大输出 | 128K tokens |
| 输入定价 | $10 / 百万 tokens |
| 输出定价 | $50 / 百万 tokens |
| 思考机制 | Adaptive Thinking(强制,不可关闭) |
| 数据留存 | 30 天(强制,不可设为零) |
| 视觉能力 | 图表、网页截图、UI 设计稿理解 |
| 子代理 | 单会话可并行调度数百个 |
两个「强制」设计定义了 Fable 5 的产品哲学:Adaptive Thinking 不可关闭,数据留存不可设为零。前者意味着每次调用都经历完整推理链;后者意味着企业无法选择「用完即焚」。
Adaptive Thinking:不是 Extended Thinking 的升级版
Fable 5 的思考机制叫 Adaptive Thinking,与之前的 Extended Thinking 有本质区别:
| 维度 | Extended Thinking(旧) | Adaptive Thinking(Fable 5) |
|---|---|---|
| 开关 | 可手动开启/关闭 | 强制开启,不可关闭 |
| 预算控制 | 可设定 thinking budget | 设定 budget 或预填充会返回 HTTP 400 |
| 思考深度 | 固定预算 | 自适应——任务越复杂,思考越深 |
| 长任务表现 | 长时间后易「越走越偏」 | 官方称「任务越长越复杂,领先幅度越大」 |
手动关闭、设定预算、预填充 thinking 内容——这些在旧版中合法的操作,在 Fable 5 中全部返回 HTTP 400 错误。Anthropic 的态度很明确:这个模型的思考过程不是可选附件,是核心能力的一部分。
对开发者的实际影响:API 调用成本不可压缩到「纯输入输出」,每次请求都包含思考 token 消耗。但换来的是长程任务的稳定性——不会出现 Opus 4.8 那种「前 30 步完美,第 31 步突然跑偏」的问题。
Claude Code 集成:从辅助到自主
Claude Fable 5 对 Claude Code(Anthropic 的 CLI 编程工具)的意义不是「更快的补全」,而是工作模式的根本切换。
在 Fable 5 之前,Claude Code 的使用模式是:人提需求 → AI 写代码 → 人审查 → 人提修改 → AI 修改。每一步都需要人参与。
Fable 5 之后,模式变成了:人描述目标 → AI 自主规划数百步 → 并行调度子代理 → 自主执行 → 人验收结果。官方声称的能力包括:
- 5000 万行代码迁移:一天内完成,传统团队需要数月
- 数百子代理并行:单会话内同时推进多个子任务
- 截图重建应用:看一张 UI 截图,直接生成可运行代码
- 蛋白质科研任务:速度约为前代的 10 倍
这些能力的共同特征是:不需要人在中间环节介入。AI 从「工具」变成了「同事」——你给它一个目标,它自己决定怎么达成。
与 Opus 4.8 的对比:同门之争
Fable 5 发布时,Anthropic 的上一代旗舰是 Claude Opus 4.8。两者的定位差异:
| 维度 | Fable 5 | Opus 4.8 |
|---|---|---|
| 定价(输入/输出) | $10 / $50 | $5 / $25 |
| 思考机制 | 强制 Adaptive Thinking | 可选 Extended Thinking |
| 数据留存 | 强制 30 天 | 可设为零留存 |
| 长任务稳定性 | 越长越强 | 长时间后易偏移 |
| 适用场景 | 长程自主任务、大规模工程 | 短中程对话、快速迭代 |
| 安全降级 | 敏感请求转交 Opus 4.8 | 直接处理 |
Fable 5 的价格是 Opus 4.8 的两倍,但在长程任务上的稳定性提升远超两倍。一个值得注意的细节:当 Fable 5 遇到网络攻击、生化武器、模型蒸馏类请求时,会自动降级转交 Opus 4.8 处理并返回拒绝状态。未产生输出的拦截请求不计费。
另一个对中国开发者有实际影响的点:Fable 5 使用了新分词器,相同中文内容约多计 30% tokens。这意味着中文场景的实际成本比英文场景高出近三分之一。
封禁之后:国产替代的现状
Fable 5 被禁后(详见封禁事件报道),国产模型集体迎来了窗口期。当前的替代格局:
| 场景 | Fable 5 被禁前 | 当前替代方案 |
|---|---|---|
| 长程代码迁移 | Fable 5(唯一选择) | GLM-5.2(开源最强) |
| Agent 自主执行 | Fable 5 | Hy3 正式版 + Qwen 3.8 Max |
| 截图转代码 | Fable 5 | Qwen 3.8 Max(多模态) |
| 快速编码迭代 | Opus 4.8 | DeepSeek V4 / Kimi K2.7 |
GLM-5.2 在编程实战中摸到了第一梯队门槛,744B MoE + MIT 开源让它成为 Fable 5 被禁后最直接的替代。但在「数百子代理并行」和「5000 万行代码一天迁移」这种极端长程任务上,目前没有任何国产模型声称达到同等水平。
定价与可用性
| 渠道 | 状态 | 定价 |
|---|---|---|
| Anthropic 官方 API | 暂停(封禁中) | $10/$50 per M tokens |
| AWS Bedrock | 暂停 | 略高于官方 |
| OpenRouter | 暂停 | $10-12/$50-55 |
| 6/9-6/22 试用期 | 已结束 | 免费 |
| 6/23 起 | 计入订阅额度 | — |
截至 2026 年 7 月 20 日,Fable 5 仍处于封禁状态。Anthropic 表示「正在努力恢复访问」,但未给出时间表。对于依赖 Fable 5 的团队,迁移到 GLM-5.2 或等待 Qwen 3.8 Max 正式版是当前最现实的选择。
写在最后
Claude Fable 5 的三天生命周期,是 AI 行业的一个隐喻:技术能力已经跑到了政策框架前面。一个模型可以在一天内完成团队两个月的工作,但一纸政令可以让它在 72 小时内从地球上消失。
Fable 5 真正改变的不是 benchmark 排名,而是开发者对「AI 能自主做到什么程度」的认知上限。这个认知一旦被建立,即使模型被禁,行业标准也回不去了。
对 AI 编程工具链的连锁影响
Fable 5 的发布和封禁,对全球 AI 编程工具链产生了连锁反应。
工具层面的重新洗牌。Claude Code 在 Fable 5 加持下曾短暂成为最强 AI 编程工具——单会话数百子代理并行、5000 万行代码一天迁移。封禁后,Claude Code 回退到 Opus 4.8,能力断崖式下降。依赖 Claude Code 的团队被迫寻找替代方案。
国产工具的窗口期。封禁事件直接利好国产 AI 编程工具。Qoder CN IDE 的模型选择器、TRAE CN 的免费策略、CodeBuddy 的 Hy3 集成——都在 Fable 5 缺席的窗口期加速获客。
「模型主权」概念兴起。一纸政令可以让最强模型在 72 小时内消失——这个事实让所有依赖单一海外模型的产品意识到:模型供应链的韧性比模型能力更重要。国产模型的价值不再只是「便宜」,而是「不会被突然关掉」。
中文开发者的实际成本
Fable 5 的新分词器对中文内容约多计 30% tokens,这是一个容易被忽视但影响巨大的细节。
实际成本计算:假设一个中文编程任务需要 10 万 tokens 的输入和 2 万 tokens 的输出。在旧分词器下,实际消耗约 7.7 万输入 + 1.5 万输出;在 Fable 5 新分词器下,消耗 10 万输入 + 2 万输出。成本差异:
| 场景 | 旧分词器成本 | Fable 5 成本 | 差异 |
|---|---|---|---|
| 10 万输入 + 2 万输出 | $0.77 + $1.00 = $1.77 | $1.00 + $1.00 = $2.00 | +13% |
| 纯中文长文档(50 万 tokens) | ~$3.85 | ~$5.00 | +30% |
对于以中文为主的开发团队,Fable 5 的实际使用成本比英文团队高出近三分之一。这进一步削弱了 Fable 5 在中国市场的竞争力——即使没有封禁,成本劣势也会让很多团队选择国产替代。
技术遗产:Adaptive Thinking 的影响
即使 Fable 5 被禁,它引入的 Adaptive Thinking 机制已经影响了整个行业的设计思路。
在 Fable 5 之前,「思考」是可选的——开发者可以关闭 extended thinking 来降低成本和延迟。Fable 5 证明了:在长程复杂任务中,强制思考带来的稳定性提升远超其成本。
这个理念已经被其他模型吸收。Qwen 3.8 Max 的「推理不可关闭」设计,Hy3 正式版 的快慢思考融合——都在不同程度上借鉴了 Fable 5 的「思考即默认」哲学。区别只在于是否允许完全关闭(Hy3 允许 no-think,Qwen 3.8 Max 不允许)。
Fable 5 的另一个技术遗产是「单会话数百子代理」。这种大规模并行 Agent 执行的模式,正在被 Google 的 Antigravity Managed Agents 和阿里的 QoderWake CN 以不同形式实现。