Claude Fable 5 发布:首个面向公众的 Mythos 级 AI 模型 — 定价、基准测试与安全护栏全解析
Anthropic 于 2026 年 6 月 9 日发布 Claude Fable 5,这是首个向公众开放的 Mythos 级模型。定价 $10/$50 每百万 Token,SWE-bench Verified 达 95%,SWE-bench Pro 达 80%,配备多层安全护栏。
Claude Fable 5 发布:首个面向公众的 Mythos 级 AI 模型
2026 年 6 月 9 日,Anthropic 发布了 Claude Fable 5 —— 这是有史以来第一个向公众开放的 Mythos 级模型。它与受限制的 Claude Mythos 5(仅限经过审查的合作伙伴使用)共享相同权重,但配备了多层安全护栏,在敏感查询上会回退到 Opus 4.8。
结果就是:这是 Anthropic 有史以来面向广泛用户发布的最强大的模型,也是开发者们在发布时面临的最复杂的权衡取舍。
什么是 Mythos 级?
Anthropic 的模型产品线构成了一条能力阶梯:Haiku(速度)、Sonnet(平衡)、Opus(难题)、以及现在的 Mythos —— 一个比 Opus 更高的层级,专为真正艰巨的任务而设计。Fable 5 是这个层级首次向一般用户开放。
Andrej Karpathy 将其描述为"一次值得大版本号跳升的阶跃式进步,与 2025 年 11 月 Claude 4.5 的幅度相当",并指出这种差距在长时间、复杂的多步问题上尤为明显,而非简单的单次问答。
基准测试亮点
Anthropic 自行报告的基准测试显示 Fable 5 在几乎所有主要评估中均占据领先地位:
| 基准测试 | Fable 5 分数 | Opus 4.8 分数 | 提升幅度 |
|---|---|---|---|
| SWE-bench Verified | 95.0% | 90.8% | +4.2% |
| SWE-bench Pro | 80.3% | 69.2% | +11.1% |
| FrontierCode Diamond | 29.3% | ~20% | +9 分 |
| GDPval-AA (Elo) | 1932 | ~1850 | +80 |
| Terminal-Bench* | — | — | 20.9% 拒绝率 |
*Terminal-Bench 上 20.9% 的测试触发了 Fable 5 的安全拒绝,之后模型回退到 Opus 4.8 完成剩余任务。
SWE-bench Pro 上超过 Opus 4.8 的 11 分优势是最强有力的编码信号。在 FrontierCode(一个尚未饱和的高难度基准测试)上,Fable 5 以 29.3% 的 Diamond 子集分数夺得第一。
定价:每百万 Token $10/$50
| 模型 | 输入(每百万 Token) | 输出(每百万 Token) |
|---|---|---|
| Claude Fable 5 | $10 | $50 |
| Claude Opus 4.8 | $5 | $25 |
| Mythos Preview(已退役) | $25 | $125 |
按 $10/$50 的定价,Fable 5 是 Opus 4.8 的 2 倍价格,但不到已退役的 Mythos Preview 的一半。提示缓存折扣(输入缓存 90% 折扣)和批量定价也已可用,但对于习惯 Opus 级开支的团队来说,如果将所有流量路由到 Fable 5,账单将翻倍。
安全架构:同一模型,两种面貌
Fable 5 的标志性特性是其安全护栏层 —— 这也是此次发布引发广泛讨论的原因。
Fable 5 和 Mythos 5 共享完全相同的权重。区别在于安全包装:
- Claude Mythos 5:不受限制的模型,仅限经过审查的网络安全和生物合作伙伴使用
- Claude Fable 5:相同权重,但在三个领域受到分类器的保护:网络安全、生物/化学、模型蒸馏尝试
当请求触发分类器时,Fable 5 会执行以下两种操作之一:
- 透明回退(Anthropic 客户端应用):改用 Opus 4.8 提供服务,用户会收到通知
- 硬性拒绝(Messages API 默认):请求被阻止,除非开发者显式实现 Opus 回退
Anthropic 估计不到 5% 的会话会触发回退,超过 95% 的 Fable 会话完全由 Fable 自己的响应完成。但网络安全、生物和化学领域的合规工作会将 Mythos 级模型降级为 Opus 4.8。
隐形限制 —— Simon Willison 的发现
知名开发者 Simon Willison 指出了一个更微妙的问题:Fable 5 配备了隐形安全护栏,可以在不通知用户的情况下静默限制其有效性。这些护栏适用于"窄范围"的前沿模型开发话题——不是通过模型回退,而是通过开发者无法察觉的提示修改、引导和输出过滤。
这意味着 Fable 5 可能看似完整地回答了问题,但实际上提供了经过过滤或降级的响应。正如 Willison 所说:"如果 Claude Fable 停止帮助你,你永远不会知道。"
Anthropic 在其系统卡中确认了这一点,称这些隐形护栏针对的是前沿大模型开发类的工作,影响大约 0.03% 的流量。但这一先例 —— 一个能够静默降级响应的模型 —— 其隐私和透明度影响远超被影响的极小比例查询。
免费使用窗口:6 月 9 日至 22 日
Fable 5 在 Pro、Max、Team 和 Enterprise 订阅计划中免费使用至 2026 年 6 月 22 日。之后该模型需要使用积分付费 —— 本质上使其成为订阅者的按量付费附加项。这个推广窗口为开发者提供了两周的试用期,让他们在实际工作负载上评估模型,然后再确定预算。
对开发者的实际影响
对于编码和软件工程(核心受众):Fable 5 是一个真正的飞跃。长时间编码任务、大型重构、多步骤代理工作流、迁移五千万行代码库 —— 这些正是 Mythos 级能力发挥价值的地方。日常编码工作几乎不会触发安全回退。SWE-bench Pro 80.3% 是一个真实的 11 分提升,早期用户的反馈与基准测试数据一致。
对于安全研究和生命科学团队:Fable 5 的安全护栏是真正的限制。合法的安全工具开发和生物/化学分析会触发分类器并降级到 Opus 4.8。这些团队应围绕防护措施规划提示策略,或通过 Anthropic 的合作伙伴计划申请 Mythos 5 访问权限。
对于成本敏感型团队:以 Opus 4.8 两倍的价格,Fable 5 不适合放在每个调用后面。根据任务复杂度路由 —— Fable 5 用于困难的长任务,Opus 4.8 或 Sonnet 用于日常流量。在推算预算前,请衡量自己的工作负载中每次任务的 Token 消耗。
对于所有用户:在免费窗口期(6 月 9 日至 22 日)在你的具体工作流上测试安全护栏。隐形限制值得关注,尽管 0.03% 的流量估计表明大多数开发者不会遇到。但如果你的工作涉及前沿模型开发、网络安全或生物/化学,请明确规划回退行为。
HN 社区反应
Hacker News 讨论(900+ 分,400+ 评论)集中在三个主题上:
- 基准测试兴奋:通过 Claude Code 测试 Fable 5 的开发者在复杂重构和多文件变更上报告了显著改进,证实了 Anthropic 的基准测试数据
- 安全护栏争议:隐形限制的发现主导了整个帖子,评论从"首次公开 Mythos 级模型的合理做法"到"不透明 AI 的危险先例"不等
- 定价担忧:按 $10/$50 的价格,许多开发者注意到长时间会话的成本可能失控,尤其是在启用扩展思考模式的情况下
声明:本站部分链接为联盟营销链接,我们可能从中获得佣金,不会增加您的额外费用。

主题中心
2026 AI 编程工具全景指南
从 Copilot 改版到 Claude Code / DeepSeek 低成本方案——把分散资讯收成可搜索、可对比的工具矩阵。
进入「2026 AI 编程工具全景指南」 →赚钱视角
这个趋势怎么赚钱?
WayToClawEarn 的差异在可验证的赚钱案例,而不只是资讯。从这些复盘开始:
浏览全部案例 →