Claude Fable 5 与 Mythos 5 发布
Anthropic 发布 Fable 5 和 Mythos 5:Fable 5 是加上安全防护、面向公众开放的 Mythos 级模型;Mythos 5 是同一模型的低限制版本,只向经过审核的网络安全防御方开放。Anthropic 称 Fable 5 在几乎所有测试过的评测中都是最高水平;部分敏感请求会改由 Opus 4.8 回答。
发生了什么
6 月 9 日,Anthropic 同时推出两个模型:
- Claude Fable 5:公司称它是「已经做到可以安全地普遍使用」的 Mythos 级模型,官方称当天「在所有平台」开放。
- Claude Mythos 5:和 Fable 5 是同一个底层模型,但在部分领域取消了安全限制。它首先通过 Project Glasswing 提供给合作方,作为 4 月发布的 Mythos Preview 的升级版,Anthropic 称它拥有「世界上最强的网络安全能力」。
两者价格相同:每百万 token 输入 10 美元、输出 50 美元,不到 Mythos Preview 的一半。
它有多强
Anthropic 说,Fable 5 在软件工程、知识工作、图像理解、科学研究等方面都处于最高水平,而且任务越长、越复杂,领先越多。下图是最常被引用的编程评测 SWE-Bench Pro,它要求模型修复真实开源项目中的问题:
表中显示 Mythos 5 和 Fable 5 中较高的分数;Anthropic 称这项评测上两者相差 1 到 3 个百分点。 来源:Anthropic《Claude Fable 5 and Claude Mythos 5》评测表,2026-06-09
在衡量真实知识工作的 GDPval-AA 上,它的评分为 1932,高于 Opus 4.8 的 1890、GPT-5.5 的 1769 和 Gemini 3.1 Pro 的 1314。
但它并非处处领先:在操作电脑的 OSWorld-Verified 上,Mythos Preview(85.4%)略高于它(85.0%);在「人类最后的考试」(可用工具)上,Mythos Preview 也以 64.7% 对 64.5% 略胜。
Anthropic 和早期测试客户举了一些具体例子(均未经独立核实):
- 大型代码迁移:Stripe 公司说,在一个 5000 万行的 Ruby 代码库里,Fable 5 一天就完成了全库迁移,人工做的话一个团队要花两个多月。
- 只靠「看」玩游戏:以前的 Claude 模型即使有辅助工具也很难玩通《宝可梦 火红》,Fable 5 只看游戏截图就通关了。
- 记笔记、长期工作:玩卡牌游戏《杀戮尖塔》时,给它一个可以持久保存笔记的文件,表现提升幅度是 Opus 4.8 的三倍。
- 科研:Anthropic 的蛋白质设计专家用 Mythos 5,把药物设计的部分环节加速了约 10 倍;14 个蛋白质靶点中有 9 个得到了有希望的候选分子。在盲评中,公司科学家约 80% 的情况下更喜欢 Mythos 提出的分子生物学假说。
安全防护怎么工作
Anthropic 坦言,Mythos 级模型「已经达到会带来重大风险的门槛」。Fable 5 的核心防护是一组分类器:独立运行的小型 AI 系统,专门识别可能的滥用。
- 1分类器检查请求先经过独立的安全分类器,判断是否涉及网络安全、生物与化学,或「蒸馏」(批量提取模型能力去训练别的模型)。
- 2没有触发绝大多数对话属于这种情况,由 Fable 5 正常回答。Anthropic 称超过 95% 的会话从未触发,此时表现与 Mythos 5 基本相同。
- 3触发了回答自动改由下一档的 Claude Opus 4.8 给出,并告知用户。Anthropic 认为这比直接拒绝体验更好。
- 4事后监控所有 Mythos 级模型的流量保存 30 天,用于发现新的「越狱」手法,之后在几乎所有情况下删除。
来源:Anthropic 官方公告,2026-06-09
Anthropic 公布的测试结果:外部漏洞悬赏项目超过 1000 小时的测试中,没人找到通用越狱;外部红队机构在长任务上也没有找到,但英国 AI 安全研究所(UK AISI)在短暂的初步测试中「取得了一些进展」。公司也承认,完全杜绝通用越狱「很可能做不到」,目标是让越狱足够慢、足够贵,以便在被大规模使用前发现并阻止。
为了尽快、安全地发布,Anthropic 把防护调得偏严:它承认,无害的问题有时也会被拦下,大多数生物和化学类问题也会转给 Opus 4.8。
和其他模型比
从官方评测表看,Fable 5 / Mythos 5 在列出的大多数项目上领先 OpenAI 的 GPT-5.5 和谷歌的 Gemini 3.1 Pro。不过,表格里打星号的项目(网络安全、生物、Terminal-Bench 2.1 等)Mythos 5 和 Fable 5 差距较大:因为安全防护会把这些任务转给 Opus 4.8,Fable 5 在这些项目上的表现更接近 Opus 4.8,而不是表中的分数。
Anthropic 的自动对齐评估显示,Mythos 5 的不当行为(如欺骗、配合用户滥用)水平较低,与 Opus 4.8 相近。
需要注意的地方
- 分数来自厂商自己。 评测表由 Anthropic 发布,并且只显示 Mythos 5 和 Fable 5 中较高的那个分数。
- 用户会碰到「被降级」。 敏感话题会改由 Opus 4.8 回答,Anthropic 自己也说防护「比理想状态更严格」。
- 数据保留政策变了。 所有 Mythos 级模型的企业流量都要保留 30 天。Anthropic 说不会用这些数据训练模型,但这对部分企业客户是实际成本。
- 很快就出事了。 发布三天后,美国商务部以一份报告中的「越狱」方法为由下令管制,Anthropic 不得不让两个模型全面下线。经过见《美国出口管制令迫使 Anthropic 暂停最新模型》。
普通人怎么用
- 订阅用户:发布时,Fable 5 在 Pro、Max、Team 和按席位计费的 Enterprise 套餐中免费提供到 6 月 22 日,之后改为消耗额外的「用量额度」(usage credits)。7 月 1 日重新上线后,Pro、Max、Team 和部分 Enterprise 套餐可以用它消耗最多 50% 的每周用量上限,7 月 7 日后同样改为用量额度。套餐价格见本站的 Claude 产品页。
- 开发者:通过 Claude API 使用
claude-fable-5,每百万 token 输入 10 美元、输出 50 美元。 - 后续版本:9 月 1 日发布的 Fable 5.1 降低了成本并放宽了部分防护;9 月 22 日的 Opus 5.5 据官方说在大多数工作上已达到 Fable 5.1 的水平。
模型摘要
- 开发方
- Anthropic
- API 价格
- 每百万 token 输入 10 美元 / 输出 50 美元
官方说法
- 安全防护平均在不到 5% 的会话中触发
- 价格不到 Mythos Preview 的一半
数据口径:Anthropic 官方公告