Claude Fable 5 发布:首个面向公众的 Mythos 级 AI 模型——定价、基准测试和安全护栏详解
AI industry analysis
核心结论
2026年6月9日,Anthropic 正式发布 Claude Fable 5——首个面向公众的 Mythos 级 模型。定价 $10/$50 每百万 token(Opus 4.8 的 2 倍),在 SWE-Bench Pro 上达到 80.3%,Terminal-Bench 2.1 上达到 88%,但同时引入了安全护栏,将网络安全、生物学和化学相关查询自动回退到 Opus 4.8。完全无限制的 Claude Mythos 5 仅限审核通过的 Project Glasswing 合作伙伴使用。
事件回顾
2026年6月9日,Anthropic 同时发布了两款前沿模型——Claude Fable 5 和 Claude Mythos 5——这是该公司首次向公众开放此前受到严格限制的 Mythos 级技术。
| 项目 | 详情 |
|---|---|
| 发布日期 | 2026年6月9日 |
| 模型等级 | Mythos 级(首个公开版本) |
| 上下文窗口 | 100万 token(默认) |
| 最大输出 | 每次请求 128K token |
| API 定价 | 输入 $10/100万,输出 $50/100万 |
| 计划可用性 | Pro、Max、Team、Enterprise(6月9-22日免费) |
| 云平台 | Anthropic API、AWS Bedrock、GCP Vertex AI |
Fable 5 和 Mythos 5 使用相同的底层模型,区别在于安全机制。Fable 5 使用保守的安全分类器,将高风险查询自动转交 Claude Opus 4.8 处理;而 Mythos 5 限制更少,仅限 Anthropic 的 Project Glasswing 合作伙伴和部分生物学研究人员使用。
"Claude Fable 5 是首个在我们的核心分析基准测试中突破 90% 的模型——比 Opus 提升了 10 个百分点," Anthropic 在官方公告中写道。
安全护栏:Fable 5 会屏蔽什么
Claude Fable 5 最具争议性的特征不是它能做什么——而是它拒绝对哪些话题做出完整回应。
| 受限领域 | 行为 | 触发率 |
|---|---|---|
| 网络安全 | 回退到 Opus 4.8 | <5% 会话 |
| 生物学 | 回退到 Opus 4.8 | <5% 会话 |
| 化学 | 回退到 Opus 4.8 | <5% 会话 |
| 模型蒸馏 | 回退到 Opus 4.8 | <5% 会话 |
| AAV 基因载体研究 | 直接屏蔽 | 罕见 |
Anthropic 的理由是:Mythos 级模型在前沿网络安全和生物学领域对"恶意行为者有显著的赋能风险"。随模型发布的系统卡详细评估显示,Mythos 级模型可能大幅降低攻击性网络操作和生物武器设计的门槛。
安全系统分两层运作:
- 显式拦截——涉及网络安全漏洞、生物武器或化学合成的查询会被明确拒绝或回退到 Opus 4.8,用户会看到清晰的回退提示。
- 隐蔽拦截——部分高风险能力(如模型蒸馏尝试、AAV 衣壳蛋白修饰)会在用户不知情的情况下被静默屏蔽。模型返回安全回复但不提示干预。
回退不是简单的"我无法回答"。Fable 5 会静默将查询移交 Opus 4.8,后者可能仍以较低能力回答该问题。这一设计在开发者社区引发了争议——一些人认为这损害了模型透明度的信任基础。
基准测试:Fable 5 的统治级表现
Anthropic 发布了全面的基准数据,对比 Fable 5/Mythos 5 与 Opus 4.8、GPT-5.5 和 Gemini 3.1 Pro:
| 基准测试 | Fable 5 / Mythos 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-Bench Pro | 80.3% | ~55% | 58.6% | 54.2% |
| SWE-Bench Verified | 95% | — | — | — |
| Terminal-Bench 2.1 | 88.0% | 82.7% | 83.4% | 70.7% |
| 分析基准 (Hex) | 90%+ | ~80% | — | — |
| AIME 2025 (数学) | ~92% | ~82% | ~88% | ~85% |
最亮眼的数据是 SWE-Bench Pro 80.3% ——比 GPT-5.5 高出 22 个百分点,比 Gemini 3.1 Pro 高出 26 个百分点。这意味着 Fable 5 能自主解决 80% 的真实世界软件工程任务,这一能力使其在自主编程方面稳居"初级到中级开发者"的水平。
在 Terminal-Bench 2.1(测试长周期终端型 Agent 任务)上,Fable 5 的 88% 比 Opus 4.8 高出 5.3 个百分点——对于运行复杂自动化管线的用户来说,这是显著的提升。
定价现实检查
输入 $10/百万 token、输出 $50/百万 token 的定价使 Claude Fable 5 成为市场上最贵的前沿模型:
| 模型 | 输入 $/100万 | 输出 $/100万 | 成本比 (vs Fable 5) |
|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 1× (基准) |
| Claude Opus 4.8 | $5 | $25 | 0.5× |
| Claude Sonnet 4.6 | $3 | $15 | 0.3× |
| GPT-5.5 | $2 | $10 | 0.2× |
| Gemini 3.5 Flash | ~$0.35 | ~$1.40 | ~0.03× |
对输出 token 来说,Fable 5 是 GPT-5.5 的 5 倍。对于重度编码 Agent 使用场景(这正是 Fable 5 最擅长的领域),这个溢价累积很快。
缓解因素:
- 免费体验窗口: 6月9-22日,Pro/Max/Team/Enterprise 用户无需额外付费
- 缓存: Prompt 缓存只需 $1/百万 token 读取,$12.50/百万写入(5分钟),$20/百万写入(1小时)
- 批量 API: 享 50% 折扣,$5/$25 每百万 token
尽管价格高昂,SWE-Bench Pro 上的绝对领先优势(80.3% vs GPT-5.5 的 58.6%)意味着,对于需要自主解决复杂工程问题的任务,Fable 5 实际上可能更便宜——每次成功解决问题的 token 成本更低。
HN 社区反应
Fable 5 发布在 Hacker News 上获得 2159 分和 1669 条评论——2026 年最活跃的 AI 讨论帖之一。关键主题:
🟢 对能力的兴奋:开发者测试 Fable 5 后在长周期编码任务上体验到了显著提升。多位评论者分享了 Fable 5 成功解决 Opus 4.8 和 GPT-5.5 无力应对的复杂重构和调试任务的经验。
🟡 对安全护栏的担忧:安全回退是最受争议的功能。批评者认为屏蔽网络安全查询损害了安全研究人员的使用体验。Anthropic 的回应:有资质的安全专业人士可以通过 Project Glasswing 获取 Mythos 5 的完整能力。
🔴 定价焦虑:$50/百万 token 的输出定价引发了大量讨论。"按照这个价格,Fable 5 是给有专门 AI 预算的企业团队用的,不是给独立开发者用的,"一位高赞评论写道。
🟣 "双层 AI"辩论:多条评论线程认为 Fable 5 vs Mythos 5 的区分代表了一个令人担忧的先例——强大的模型仅限于少数有关系的用户,公众只能使用经过"净化"的版本。Anthropic 反驳称这是负责任的部署,而非设置门槛。
这对你意味着什么
对开发者和 AI 工具用户
-
更精准而非更便宜的编码:如果你今天在用 Claude Code 或 Cursor 搭配 Opus 4.8,升级到 Fable 5 能更自主地解决复杂问题——但每次会话成本约翻倍。对于简单的补全任务,继续使用 Sonnet 4.6 即可。
-
免费窗口至关重要:6月9-22日的现有计划免费体验期是你零边际成本评估 Fable 5 的机会。在此期间运行你最重的自动化管线,判断升级是否值这个溢价。
-
了解安全边界:如果你的工作流涉及网络安全(渗透测试、漏洞研究)或生物/化学分析,Fable 5 会静默回退到 Opus 4.8。提前做好规划——要么用 Mythos 5(如果你有资格),要么对这类任务使用 GPT-5.5 作为备选管线。
对联盟营销和工具策略
这是一个明确信号,表明需要深化 WayToClawEarn 的 Claude 内容集群:
- 更新现有定价指南,加入 Fable 5 的 $10/$50 费率
- 添加 Fable 5 vs Opus 4.8 成本对比计算器
- 创建如何配置 Prompt Caching 来抵消 Fable 5 成本的教程
- 安全护栏争议是Case 文章的绝佳角度:"安全研究人员如何绕开 AI 模型的限制"
信息来源
主题中心
2026 AI 编程工具全景指南
从 Copilot 改版到 Claude Code / DeepSeek 低成本方案——把分散资讯收成可搜索、可对比的工具矩阵。
进入「2026 AI 编程工具全景指南」 →赚钱视角
这个趋势怎么赚钱?
WayToClawEarn 的差异在可验证的赚钱案例,而不只是资讯。从这些复盘开始:
浏览全部案例 →