Claude Fable 5 和 Claude Mythos 5
Claude Fable 5 and Claude Mythos 5
Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发率低于 5% 的会话。Mythos 5 通过 Project Glasswing 向网络安全防御者开放。
Anthropic把最危险的模型安全地放出来了,Fable 5在编码、科研上不是小数点级别的提升,价格还砍半,95%的请求直接跑满血版,必读。

Update
Claude Mythos 5 与 Fable 5 重新开放使用
2026年7月1日
Claude Fable 5 与 Mythos 5 现已正式发布。
阅读更多
Claude Mythos 5 与 Fable 5 访问不可用
2026年6月12日
我们正在暂停 Claude Fable 5 和 Claude Mythos 5 的访问。对于由此给客户造成的中断,我们深表歉意,并正在努力尽快恢复访问。
阅读更多
今天,我们正式推出 Claude Fable 5:一款 Mythos 级1模型,我们已确保其可安全用于通用场景。
Fable 5 的能力超越了我们以往发布的任何模型。它在几乎所有测试过 AI 能力的基准上均处于最先进水平,在软件工程、知识工作、视觉、科学研究等众多领域展现出卓越性能。任务越长、越复杂,Fable 5 相对于我们其他模型的领先优势就越大。
发布如此强大的模型伴随着风险。如果没有防护措施,Fable 5 在网络安全等领域的能力可能被滥用并造成严重损害。因此,我们为该模型上线了防护措施:针对某些主题的查询将转而由我们次强大的模型 Claude Opus 4.8 进行回复。为了既安全又快速地发布该模型,我们对这些防护措施进行了保守调优——它们有时会误拦无害请求,不过平均在不到 5% 的会话中触发。随着未来几个月更强大的模型陆续到来,我们正在努力尽快改进防护措施并降低误报率。
面向少数网络防御者和基础设施提供商,我们还将发布 Claude Mythos 5。它与 Fable 5 是同一底层模型,但在某些领域解除了防护措施。2 Mythos 5 初期将通过与lin美国政府合作的 Project Glasswing 部署,作为 Claude Mythos Preview 的升级版。它拥有全球所有模型中最强大的网络安全能力。很快,我们计划通过更广泛的可信访问计划扩大对 Mythos 5 的访问范围。
像 Fable 5 和 Mythos 5 这样强大的模型,有能力为世界带来深远的福祉。在 Project Glasswing 中,我们已经看到了这种前景的开端——模型帮助 网络防御者 保护至关重要的软件。在生命科学研究领域也是如此,模型正在提出新颖的假设,加速新疗法开发的进程。
Fable 5 和 Mythos 5 的定价为每百万输入 token 10 美元、每百万输出 token 50 美元——不到 Claude Mythos Preview 价格的一半。今天的联合发布是我们朝着目标迈出的又一步:以尽可能快、尽可能安全的方式,把先进的 AI 能力带给尽可能多的用户。
评测 Claude Fable 5 和 Claude Mythos 5
下表将 Fable 5 和 Mythos 5 的能力与其他领先模型进行了对比。

Fable 5 和 Mythos 5 能够比以往任何 Claude 模型自主工作更长的时间。下面我们将讨论这些技能如何应用于软件工程,并介绍该模型在知识工作、视觉、记忆以及生命科学研究方面改进的能力。
软件工程。在早期测试中,Stripe 反馈称,Fable 5 把数月的工程工作压缩到了几天之内。在一个拥有 5000 万行代码的 Ruby 代码库中,该模型在一天内完成了全代码库范围的迁移,而人工完成这项工作需要整个团队两个多月的时间。Fable 5 还比以往的 Claude 模型更节省 token:在 Cognition 的 FrontierCode 评测中——该评测测试模型能否在通过困难编码任务的同时满足高质量生产级代码库的标准——Fable 5 即使在中等推理力度下,也在前沿模型中得分最高。


知识工作。Fable 5 在复杂的分析类任务上表现出色。在 Hebbia 面向高层级推理的 Finance Benchmark 上,Fable 5 取得了所有模型中的最高分,在基于文档的推理、图表与表格解读以及问题求解方面均有显著提升。IMC 指出,Fable 5 在他们的交易分析评测中几乎全面拔得头筹,包括事实查询、概念推理、根因分析和期望值分析。
视觉。Fable 5 是涉及视觉任务的新一代 SOTA 模型。它可以从精细的科学图表中提取精确数字,并能执行复杂的视觉类任务,例如仅凭截图重建一个 Web 应用的源代码。它所需的外部辅助也更少:例如,此前的 Claude 模型即使借助为其提供额外实用工具的框架也难以通关《宝可梦 火红》,而 Fable 5 仅凭一个极简的纯视觉框架就通关了《宝可梦 火红》。
记忆与长上下文。在长时间运行的任务中,Fable 5 能在数百万 token 内保持专注,并利用自己记录的笔记改进输出。当我们让模型玩卡牌构筑游戏 Slay the Spire 时,为它提供持久的基于文件的记忆,其性能提升幅度是 Opus 4.8 的三倍;Fable 到达游戏最终幕的频率也是三倍。
药物设计:使用 Mythos 5,我们的内部蛋白质设计专家将药物设计流程的某些环节加速了约 10 倍。在一个例子中,我们发现 Mythos 5 在配备蛋白质设计和生物信息学工具、且没有人类协助的情况下,能够媲美甚至超越熟练的人类操作员。在此过程中,该模型完成了通常由科学家完成的全部任务:选择结合位点、挑选并运行蛋白质设计工具,以及在此过程中从失败中恢复。本研究中的 14 个蛋白质靶点中有 9 个(如下所示)产出了强力的药物设计候选物,我们目前正在对其开展研究。

分子生物学领域的新颖假说。 Mythos 5 是我们首个能够持续产出新颖且具说服力的科学假说的模型。在与 Opus 级别模型的盲测对比中,我们的科学家约 80% 的情况下更青睐 Mythos 的分子生物学假说,并已将其中若干假说推进至实验验证阶段。与此同时,Mythos 的一个假说——关于一种 大肠杆菌蛋白的新颖机制——已被一个独立研究同一问题的实验室发表的 一项研究所证实。
基因组学领域的新颖研究。Mythos 5 在长达一周多的大体自主工作中完成了新颖的基因组学研究。它整合了涵盖 138 个动物物种、数百万个细胞的单细胞数据,并设计、训练了一个定制机器学习模型,用以识别即使在亲缘关系很远的生物中执行相同功能的细胞。仅需少量高层次的人类输入,Mythos 5 训练出的模型就超越了近期发表在 Science 期刊上的一个模型——尽管其规模要小 100 倍。我们计划在未来几个月内发表这些结果。
对齐。在我们的自动化对齐评估中,我们发现 Mythos 5 的非对齐行为水平(包括模型采取的非对齐行为,如欺骗以及配合用户滥用该模型)较低,与 Opus 4.8 相当。鉴于两者是同一个底层模型,Fable 5 的对齐水平也将相似。该评估的完整描述,以及其他一系列详细的安全与能力测试,均载于该模型的 system card。

Claude Fable 5 的早期反馈
获得早期访问权限的客户对 Fable 5 进行了他们自己的测试。以下是精选摘录,以他们的原话呈现他们的所见:
Claude Fable 5 是 CursorBench 上的最先进模型。它开辟了一类此前模型无法企及的长程问题。
对于 GitHub 服务的开发者来说,Claude Fable 5 是真正的一步跨越。在早期测试中,它以超越以往基准的自主性和可靠性水平处理了复杂的长程编码任务。但最令我们兴奋的是它所指出的方向:一个开发者可以将越来越宏大的工作交给智能体并在整个软件生命周期中信任其结果的未来。
这是我们有机会测试过的所有 Claude 模型中最强的结果。Claude Fable 5 在智能体编码和原型设计上是清晰的一步跨越。
Claude Fable 5 的推理能力明显超越了 Opus 4.8。它达到了资深研究科学家的水准——选择方向、分配资源、摒弃自身错误的信念,并产出基于第一性原理的新颖成果。
Claude Fable 5 能理解构建者的意图,而不仅仅是他们输入的文字。一年前需要上百条提示词才能完成的应用,它现在一次生成即可搞定。当客户真正遇到瓶颈时,我们就是用这款模型来帮他们快速突破,让他们能完成原本想要构建的东西。
Claude Fable 5 带来了实质性的不同感受。在盲审中,我们的律师发现它对合同的修订标注每次都能持平甚至超越我们目前使用的模型。
在最高 effort 档位下,Claude Fable 5 会对自己的工作进行反思和验证。对我们来说,这正是实现高度自主运营的关键——额外的思考是物有所值的。
相比之前的模型,Claude Fable 5 能以更少的轮次交付更强大的工程能力——可以处理我们员工每天在 Claude Code 中运行的复杂多智能体工作流。
Claude Fable 5 是 FrontierBench(Cognition 的前沿编码评测)上得分最高的模型。它擅长长程推理,并且开箱即用即可泛化到陌生工具。
Claude Fable 5 是我们测试过的最强大的金融优先模型,无论是在通用金融还是在推理方面。这是一个显著的进步。
Claude Fable 5 是首个在我们以复杂、长时间运行分析任务为核心的分析基准上突破 90% 的模型——比 Opus 提升了 10 个百分点。在最难的问题上,它展现出出色的判断力和对细节的把握。
![]()
Claude Fable 5 是我们在前沿物理研究上测试过的最强模型,且推理 token 用量仅为三分之一。它在 36 小时内就几乎达到了 GPT-5.5 花了四天才取得的成果。
在 ViBench(我们的端到端 vibe-coding 基准测试)上,Claude Fable 5 是我们测试过的表现最好的模型——基础用例接近饱和,并且用更少的时间、更少的 token 构建应用。
在我们的日常电子表格测试套件中,Claude Fable 5 在每个努力等级上都击败了 Opus 4.8——而且它用更少的轮次完成,运行速度快 25–30%。
Claude Fable 5 的新安全防护措施
Mythos 级别的模型已经达到了会带来重大风险的门槛。今年 4 月,我们启动了[Project Glasswing,向仅限的一小群网络防御者和关键软件基础设施提供商发布了首个 Mythos 级模型(Claude Mythos Preview)。当时我们表示,希望最终能[向所有用户开放 Mythos 级能力,前提是我们已开发出足够强大、能可靠防止滥用的新安全防护措施。
在过去几个月里,我们一直在改进这些防护措施,如今它们已经足够稳健,可以进行普遍发布。由于我们优先考虑安全,我们刻意将防护措施调得较为谨慎,目前仍比理想状态更严格——例如,有时良性请求也会触发我们的分类器。我们明白这会让一些用户感到沮丧,我们的目标是在发布后不断更新和完善防护措施,以减少误报。
下面我们逐一讨论 Fable 5 的新安全防护措施。我们更广泛的安全防护体系在模型的系统卡和我们最新的风险报告中有介绍和评估。
安全分类器
Mythos 级模型具备的前沿网络安全和研究生物学能力,意味着它们可能为恶意行为者带来实质性的能力提升(uplift)风险。也就是说,这些模型可能提供信息或建议,帮助这些行为者造成他们从其他来源(例如互联网搜索引擎)无法获得的严重危害。此外,AI 模型的大量高级用法具有双重用途:同一些查询在网络安全专业人士和生物学研究者手中是有益的,但如果被恶意行为者获取则可能带来危险。
因此,我们需要强有力的安全防护措施来防止滥用,且其覆盖范围必须广泛。这些防护措施本身必须能够经受住持续而复杂的绕过尝试(也就是对系统进行“越狱”)。Mythos 级能力带来的提升对许多对手都很有价值——例如那些能从网络攻击中获利的人——因此我们预计他们会有动机试图绕过我们的安全措施。
Fable 5 配备了一套全新的 分类器:这些独立的 AI 系统用于检测潜在的滥用行为(包括越狱攻击),并阻止主模型(在本例中为 Fable 5)作出响应。我们已经在自己的模型上运行分类器 有一段时间了,Fable 5 的分类器是此前工作的延伸,并增加了额外的覆盖范围。
当 Fable 的分类器检测到与网络安全、生物与化学或知识蒸馏相关的请求时,响应会自动改由 Claude Opus 4.8 处理。每当发生这种情况,用户都会收到通知。Opus 4.8 本身也是一个能力极强的模型:回退到 Opus 的响应体验远好于 Fable 直接拒绝。我们的早期数据显示,超过 95% 的 Fable 会话完全没有触发回退——对于这些会话,Fable 5 的表现实际上与 Mythos 5 相同。
以下是分类器所覆盖的领域:
1. 网络安全。Mythos 级别的模型 擅长发现和利用软件漏洞,因此能让网络攻击的实施变得显著更容易、成本更低。Mythos 级别的模型还展现出强大的智能体式黑客攻击能力,这包括在寻找漏洞利用之外执行网络攻击的多个不同环节——侦察、探测、横向移动等等。为防止这些智能体式黑客攻击能力在网络攻击中提供能力提升,我们设计的网络安全分类器同时覆盖漏洞利用以及更广泛意义上的攻击性网络任务。如下图所示,我们的分类器能阻止 Fable 在这些任务上取得任何进展。

我们对分类器进行了大量红队测试,以检验其对抗越狱攻击的鲁棒性。除内部测试外,我们还开展了外部漏洞赏金计划,在超过 1,000 小时的测试中未发现任何通用越狱方法。我们聘请的外部红队测试机构迄今为止也未能在长篇智能体任务上找到任何通用越狱方法——不过英国 AISI 在短暂的初步测试窗口内已朝这一方向取得了进展。4 完全阻止通用越狱方法很可能是不可能的,但我们的目标是让任何残留的越狱方法都足够缓慢和昂贵,以便在它们被大规模使用之前检测并阻止。
下面这张来自我们内部评测的图表说明,Fable 5 的安全防护使其相比我们此前向公众开放使用的模型具有更强的越狱抵抗能力。

我们的一位外部合作伙伴发现,Fable 5 对有害网络查询的防护是所有受测模型中最强的(包括 Opus 4.8 和 Opus 4.7)。对于与策划网络攻击、漏洞利用开发或防御规避相关的有害单轮请求,Fable 5 的配合次数为零。无论请求中是否使用了 30 种不同的公开越狱技术中的任意一种,结果都是如此。
2. 生物与化学。长期以来,我们一直使用我们的分类器来阻止模型回答一小部分与生物武器相关的查询。但我们不再确定,屏蔽这一小部分内容就足够了。原因有二:第一,我们有理由担心资源充足的恶意行为者试图利用我们的模型,在高风险生物研究方面获得能力提升。其次,模型如今完成现实世界科学任务的能力已大大增强。
例如,我们测试了 Mythos 5 在设计腺相关病毒(AAV)过程中完成一个具有挑战性步骤的能力。AAV 是递送基因疗法的载体组件,但同样的能力一旦落入不当之手,也可能被用于设计危险病毒。在这项任务中,多种 AI 模型被评估预测某项基因改造会如何影响病毒外壳组装的能力(评估对象是一组由Dyno Therapeutics开发的、具有治疗相关性的未发表候选病毒)。我们并没有明确训练我们的模型来执行这一任务——然而 Mythos 级别的模型仅凭其生物学推理能力,就超越了专门面向蛋白质任务的复杂模型(即“蛋白质语言模型”)。这展示了完成基因疗法研发中简单但重要任务的可观能力——但同时也凸显了此类两用能力所带来的风险。

我们的首要任务是尽快安全地发布 Fable,哪怕为此付出防护措施过于宽泛的代价。因此,目前我们已安排 Fable 在大多数涉及生物和化学的请求上回退到 Opus 4.8。与我们的所有分类器一样,我们希望尽快收窄这些防护措施:从上面的证据可以看出,Fable 在科学领域具有巨大的正面应用潜力,我们不希望分类器的误报阻碍这一点。在未来几周内,部分生物医学研究人员和企业将能够加入我们针对 Mythos 5 生物能力的可信访问计划(下文将讨论)。
3. 知识蒸馏。我们此前已发现大规模尝试提取(“蒸馏”)Claude 的能力、以在威权国家训练竞争性模型的案例。对 Fable 5 能力的蒸馏可能间接导致近前沿 AI 能力的扩散——而这些能力可能在没有适当防护措施的情况下被发布。被我们的分类器标记为属于此类蒸馏尝试的请求,将回退到 Opus 4.8。
新的数据保留政策
最后,我们将对 Fable 5、Mythos 5 以及未来具有同等或更高能力水平的模型的商业客户数据处理方式做出调整。我们将要求对 Mythos 级别模型上的所有流量(无论是一方还是第三方平台)实行 30 天数据保留。我们不会将这些数据用于训练新的 Claude 模型,也不会将其用于任何与安全无关的目的;我们还实施了新的隐私保护措施,包括记录所有人工访问该数据的行为,并确保在几乎所有情况下于 30 天后删除数据(详情请参阅 这篇文章)。这些数据将帮助我们防御复杂的新型攻击(包括新的越狱攻击以及跨多次请求进行的攻击),并帮助我们识别和减少误报。
Claude Mythos 5 与可信访问计划
从今天起,所有目前有权访问 Claude Mythos Preview 的用户(例如 Project Glasswing 中的网络安全合作伙伴)都将能够升级到 Claude Mythos 5——它与 Claude Fable 5 是同一模型,但解除了网络安全防护限制。在大多数情况下,用户会发现 Mythos 5 与 Mythos Preview 相当,或在某些方面更强,同时成本大幅降低。
在与美国政府协商后,我们计划稳步扩大 Claude Mythos 5 的访问范围,继续定期新增合作伙伴,并推行一项可信访问计划,让网络安全组织能够以更系统化的方式提出申请。
我们的计划还包括开放一个生物学可信访问计划,借助 Mythos 级别的能力帮助加速生物医学研究并发现新疗法。该计划将提供移除了生物与化学防护(但网络防护仍然保留)的 Fable 5 访问权限。它将招募来自各类生命科学机构、涵盖基础研究和转化研究的少数研究人员;我们计划在扩大该计划访问范围的同时,不断完善我们的防护措施。
可用性
Claude Fable 5 即日起在全球范围内可用。Claude Mythos 5 目前仅限 Glasswing 合作伙伴(解除网络防护)使用,随后将向特定的生物学研究人员(解除生物与化学防护)开放,直至更广泛的可信访问计划上线。
两款模型的定价均为每百万输入 token 10 美元、每百万输出 token 50 美元。开发者可以通过 Claude API 使用 claude-fable-5。
我们预计 Fable 5 的需求会非常高,且难以预测。在 Claude API 和按用量计费的企业方案上,Fable 5 从今天起全面可用。对于订阅方案,我们更倾向于尽早提供访问,因此采取更保守的分阶段推出方式:
- 从今天起至 6 月 22 日,Fable 5 将包含在 Pro、Max、Team 以及按席位计费的企业方案中,无需额外付费。
- 6 月 23 日,我们将把这些套餐中的 Fable 5 移除。此后若要继续使用,将需要消耗用量积分。如果算力允许,我们会延长该包含窗口期。
- 在此之后——待算力充足时——我们计划将 Fable 5 恢复为订阅套餐的标准组成部分。我们会尽快做到这一点。
在此期间,我们会提前告知任何变更,让用户随时了解最新进展。
2026 年 6 月 9 日编辑:更新了关于 AAV 的讨论,注明候选产品由 Dyno Therapeutics 开发。
脚注
- Mythos 级模型是 Claude 模型的一个层级,其能力高于我们的 Opus 级。首个模型 Claude Mythos Preview 于今年 4 月通过 Project Glasswing 发布。今天紧随其后的是 Claude Fable 5 和 Claude Mythos 5。
- Fable 源自拉丁语 fabula,意为“被讲述之事”,与希腊语 mythos 词义相近。安全防护措施正是区分这两个模型(Fable 和 Mythos)的关键,也是我们为它们赋予不同名称的原因。
- 指标:Firefox = 实现任意代码执行(漏洞利用的完全成功级别)的试验比例。OSS-Fuzz = 五级评分(0.2 崩溃 → 1.0 控制流劫持)的按严重程度加权均值,因此数值是加权平均而非成功率。CyberGym = 成功复现目标漏洞的比例(即公开排行榜所用的指标)。CyScenarioBench = 在其所有挑战上等权平均的成功率。
- 通用越狱可以定义为:任何提示词、脚本或测试框架,能让用户与模型交互时表现得仿佛模型的安全防护机制不存在。这与那些只能在非常有限的场景下生效、或需要额外工作量才能适配每个新情况的较小规模越狱手段相对。
来源:Anthropic:Newsroom(网页) · anthropic.com