WayToClawEarn
中等影响independent-research

Claude Fable 5 发布:首个面向公众的 Mythos 级 AI 模型 — 定价、基准测试与安全护栏全解析

Anthropic 于 2026 年 6 月 9 日发布 Claude Fable 5,这是首个向公众开放的 Mythos 级模型。定价 $10/$50 每百万 Token,SWE-bench Verified 达 95%,SWE-bench Pro 达 80%,配备多层安全护栏。

WayToClawEarn Editorial发布 2026年6月11日更新 2026年8月8日

编辑基于公开来源复核 · AI 辅助整理。 内容方法 · 原始来源

Claude Fable 5 发布:首个面向公众的 Mythos 级 AI 模型

2026 年 6 月 9 日,Anthropic 发布了 Claude Fable 5 —— 这是有史以来第一个向公众开放的 Mythos 级模型。它与受限制的 Claude Mythos 5(仅限经过审查的合作伙伴使用)共享相同权重,但配备了多层安全护栏,在敏感查询上会回退到 Opus 4.8。

结果就是:这是 Anthropic 有史以来面向广泛用户发布的最强大的模型,也是开发者们在发布时面临的最复杂的权衡取舍。

什么是 Mythos 级?

Anthropic 的模型产品线构成了一条能力阶梯:Haiku(速度)、Sonnet(平衡)、Opus(难题)、以及现在的 Mythos —— 一个比 Opus 更高的层级,专为真正艰巨的任务而设计。Fable 5 是这个层级首次向一般用户开放。

Andrej Karpathy 将其描述为"一次值得大版本号跳升的阶跃式进步,与 2025 年 11 月 Claude 4.5 的幅度相当",并指出这种差距在长时间、复杂的多步问题上尤为明显,而非简单的单次问答。

基准测试亮点

Anthropic 自行报告的基准测试显示 Fable 5 在几乎所有主要评估中均占据领先地位:

基准测试Fable 5 分数Opus 4.8 分数提升幅度
SWE-bench Verified95.0%90.8%+4.2%
SWE-bench Pro80.3%69.2%+11.1%
FrontierCode Diamond29.3%~20%+9 分
GDPval-AA (Elo)1932~1850+80
Terminal-Bench*20.9% 拒绝率

*Terminal-Bench 上 20.9% 的测试触发了 Fable 5 的安全拒绝,之后模型回退到 Opus 4.8 完成剩余任务。

SWE-bench Pro 上超过 Opus 4.8 的 11 分优势是最强有力的编码信号。在 FrontierCode(一个尚未饱和的高难度基准测试)上,Fable 5 以 29.3% 的 Diamond 子集分数夺得第一。

定价:每百万 Token $10/$50

模型输入(每百万 Token)输出(每百万 Token)
Claude Fable 5$10$50
Claude Opus 4.8$5$25
Mythos Preview(已退役)$25$125

按 $10/$50 的定价,Fable 5 是 Opus 4.8 的 2 倍价格,但不到已退役的 Mythos Preview 的一半。提示缓存折扣(输入缓存 90% 折扣)和批量定价也已可用,但对于习惯 Opus 级开支的团队来说,如果将所有流量路由到 Fable 5,账单将翻倍。

安全架构:同一模型,两种面貌

Fable 5 的标志性特性是其安全护栏层 —— 这也是此次发布引发广泛讨论的原因。

Fable 5 和 Mythos 5 共享完全相同的权重。区别在于安全包装:

  • Claude Mythos 5:不受限制的模型,仅限经过审查的网络安全和生物合作伙伴使用
  • Claude Fable 5:相同权重,但在三个领域受到分类器的保护:网络安全、生物/化学、模型蒸馏尝试

当请求触发分类器时,Fable 5 会执行以下两种操作之一:

  1. 透明回退(Anthropic 客户端应用):改用 Opus 4.8 提供服务,用户会收到通知
  2. 硬性拒绝(Messages API 默认):请求被阻止,除非开发者显式实现 Opus 回退

Anthropic 估计不到 5% 的会话会触发回退,超过 95% 的 Fable 会话完全由 Fable 自己的响应完成。但网络安全、生物和化学领域的合规工作会将 Mythos 级模型降级为 Opus 4.8。

隐形限制 —— Simon Willison 的发现

知名开发者 Simon Willison 指出了一个更微妙的问题:Fable 5 配备了隐形安全护栏,可以在不通知用户的情况下静默限制其有效性。这些护栏适用于"窄范围"的前沿模型开发话题——不是通过模型回退,而是通过开发者无法察觉的提示修改、引导和输出过滤。

这意味着 Fable 5 可能看似完整地回答了问题,但实际上提供了经过过滤或降级的响应。正如 Willison 所说:"如果 Claude Fable 停止帮助你,你永远不会知道。"

Anthropic 在其系统卡中确认了这一点,称这些隐形护栏针对的是前沿大模型开发类的工作,影响大约 0.03% 的流量。但这一先例 —— 一个能够静默降级响应的模型 —— 其隐私和透明度影响远超被影响的极小比例查询。

免费使用窗口:6 月 9 日至 22 日

Fable 5 在 Pro、Max、Team 和 Enterprise 订阅计划中免费使用至 2026 年 6 月 22 日。之后该模型需要使用积分付费 —— 本质上使其成为订阅者的按量付费附加项。这个推广窗口为开发者提供了两周的试用期,让他们在实际工作负载上评估模型,然后再确定预算。

对开发者的实际影响

对于编码和软件工程(核心受众):Fable 5 是一个真正的飞跃。长时间编码任务、大型重构、多步骤代理工作流、迁移五千万行代码库 —— 这些正是 Mythos 级能力发挥价值的地方。日常编码工作几乎不会触发安全回退。SWE-bench Pro 80.3% 是一个真实的 11 分提升,早期用户的反馈与基准测试数据一致。

对于安全研究和生命科学团队:Fable 5 的安全护栏是真正的限制。合法的安全工具开发和生物/化学分析会触发分类器并降级到 Opus 4.8。这些团队应围绕防护措施规划提示策略,或通过 Anthropic 的合作伙伴计划申请 Mythos 5 访问权限。

对于成本敏感型团队:以 Opus 4.8 两倍的价格,Fable 5 不适合放在每个调用后面。根据任务复杂度路由 —— Fable 5 用于困难的长任务,Opus 4.8 或 Sonnet 用于日常流量。在推算预算前,请衡量自己的工作负载中每次任务的 Token 消耗。

对于所有用户:在免费窗口期(6 月 9 日至 22 日)在你的具体工作流上测试安全护栏。隐形限制值得关注,尽管 0.03% 的流量估计表明大多数开发者不会遇到。但如果你的工作涉及前沿模型开发、网络安全或生物/化学,请明确规划回退行为。

HN 社区反应

Hacker News 讨论(900+ 分,400+ 评论)集中在三个主题上:

  1. 基准测试兴奋:通过 Claude Code 测试 Fable 5 的开发者在复杂重构和多文件变更上报告了显著改进,证实了 Anthropic 的基准测试数据
  2. 安全护栏争议:隐形限制的发现主导了整个帖子,评论从"首次公开 Mythos 级模型的合理做法"到"不透明 AI 的危险先例"不等
  3. 定价担忧:按 $10/$50 的价格,许多开发者注意到长时间会话的成本可能失控,尤其是在启用扩展思考模式的情况下

声明:本站部分链接为联盟营销链接,我们可能从中获得佣金,不会增加您的额外费用。

Claude Fable 5 基准测试

查看原文 →

免责声明:本站案例均为知识分享内容,仅供灵感与参考,不构成收益承诺;由此进行的外部执行与结果请自行判断并承担相应责任。