一、模型定位与背景
Claude Fable 5 是 Anthropic 于 2026 年 6 月 9 日发布的首款公开可用的 Mythos 级(Mythos-class)模型,标志着 Anthropic 模型分级体系的重大升级——它位于 Opus 系列之上,是一个此前仅在企业级/受控访问中提供的能力等级。
Fable 5 与其"孪生"模型 Claude Mythos 5 同源:两者能力基线相同,但 Fable 5 在其上叠加了公开发布所需的安全防护层;Mythos 5 则保留原始能力,仅面向有限的高信任场景。这种"双胞胎"发布策略是 Anthropic 首次采用。
可用渠道:Anthropic 官方 API(模型 ID claude-fable-5)、Claude 官方应用(网页 / 桌面 / 移动)、Amazon Bedrock、AWS。
二、技术规格
| 项目 | 参数 |
|---|---|
| 上下文窗口 | 1,000,000 tokens(1M) |
| 最大输出 | 128,000 tokens / 请求 |
| 知识截止 | 2026 年 1 月 |
| 输入定价 | $10 / 百万 tokens |
| 输出定价 | $50 / 百万 tokens |
| 相对成本 | 约为 Opus 4.8 的 2× |
| 数据保留 | 强制 30 天(ASL-3 要求) |
| ZDR 支持 | 不支持零数据保留 |
三、核心能力详解
3.1 编程与软件工程(Fable 5 的最强项)
- SWE-bench Verified:95.0%,领先 Opus 4.8(88.6%)与 GPT-5.5(82.6%)
- SWE-bench Pro(更贴近真实生产环境):80.3%,比第二名领先约 11 个百分点(Opus 4.8:69.2%;GPT-5.5:58.6%;Gemini 3.1 Pro:54.2%)
- FrontierCode(Diamond):相较前代性能提升逾 2 倍,专门测试贴近生产级代码库标准的高难度任务
- 共同特征:任务越长、越复杂,Fable 5 的领先幅度越大——收益集中在长周期、agentic 型工作负载
3.2 多日自主运行(Multi-Day Agentic Sessions)
这是 Fable 5 相对此前所有 Claude 模型的关键差异化能力:
- 在 Claude Code 或 Claude Managed Agents 等 agent harness 中,可连续自主工作数日
- 跨阶段规划(planning across stages):将复杂目标拆解为多阶段计划
- 子代理委派(sub-agent delegation):自行派生子任务给子代理执行
- 自写测试(self-written test suites):为自身产出编写测试用例
- 自我验证(self-verification):运行测试、审查结果、迭代修复
- 利用视觉自检:通过视觉能力对照目标验证输出(如 UI 实现)
- 技能自更新:根据学习结果更新自身技能;能自行开发工具链与评估集(harnesses & evals)
3.3 视觉理解
具备对嵌入文件与 PDF 中的图表、示意图、表格的理解能力,应用场景包括金融、法律、数据分析、建筑与游戏行业的文档密集型工作。
3.4 知识型工作
在几乎所有主流 AI 能力基准测试上达到 SOTA(state-of-the-art),覆盖科研、复杂推理、长文本综合分析等。
四、安全架构详解
4.1 AI 安全等级
- Fable 5 被分类为 ASL-3(AI Safety Level 3)
- 遵循 Anthropic 的 Responsible Scaling Policy(RSP),ASL 共分 4 级
4.2 分层安全防护(Layered Safeguards)
Fable 5 附带 Mythos 5 所没有的三大安全分类器:
- 网络安全分类器(Cybersecurity classifier)——识别涉及攻击、漏洞利用、恶意代码等的请求
- 生物/化学分类器(Biology & Chemistry classifier)——识别涉及生化武器、危险物质合成等的请求
- 蒸馏防护(Distillation prevention)——阻止将 Fable 5 用于训练其他模型的行为
4.3 回退机制(Fallback to Opus 4.8)
当上述分类器触发时,响应会自动交由 Claude Opus 4.8 处理,而不是简单拒答。这种"降级不掉线"的设计降低了对普通用户的干扰。
实际影响:平均在不到 5% 的会话中触发,即 95%+ 的会话完全以 Fable 5 全能力运行。
五、发布后的波折
- 6 月 9 日 首次发布
- 因美国出口管制审查短暂下架
- 7 月初 管制解除后重新上线
- 7 月中 因竞品(OpenAI 的 Sol 模型)发布压力,Anthropic 再度延长了 Fable 5 的访问期
- 目前已稳定运行,同时市场已出现关于 Fable 5.1 后续更新窗口的讨论
六、适用与不适用场景
适合使用 Fable 5:大型代码迁移、跨系统重构、多日自主编程 Agent、复杂科研分析、金融/法律长文档综合处理、需要子代理协作与自我验证的任务。
不推荐使用 Fable 5:低延迟对话、简单问答、成本敏感场景(用 Haiku 4.5 或 Sonnet 5 更划算)、需要零数据保留的合规场景(Fable 5 强制 30 天保留)。
Sources:
- Claude Fable 5 and Claude Mythos 5 — Anthropic
- Introducing Claude Fable 5 and Claude Mythos 5 — Claude Platform Docs
- Claude Fable 5 & Claude Mythos 5 Benchmarks Explained — Vellum
- Claude Fable 5 Benchmarks: 80.3% on SWE-Bench Pro
- Claude Benchmarks (2026): Fable 5 Hits 95% SWE-bench Verified — MorphLLM
- Claude Fable 5 System Card: ASL-3 & CB-1 Explained — TechJack Solutions
- Claude Fable 5 Safety Architecture: Classifiers & Fallback
- Claude Fable 5 vs Mythos 5: The Safety Split Explained — LushBinary
- Claude Fable 5 for Long-Running Agentic Coding — MindStudio
- Anthropic Claude Fable 5 on AWS — Amazon Web Services
- Redeploying Claude Fable 5 — Anthropic
除非注明,否则均为李锋镝的博客原创文章,转载必须以链接形式标明本文链接
踩坑踩多了
文章评论