本文解释了为什么在 Claude Fable 5 或 Fable 5.1 上请求可能被阻止、对话切换到不同 Claude 模型时会发生什么,以及如何管理自动切换。
为什么某些请求被阻止
Claude Fable 5 和 Fable 5.1 的能力远远超过我们之前公开发布的任何模型。它们在几乎所有经过测试的 AI 能力基准上都处于最先进水平,在软件工程、知识工作、视觉和许多其他领域表现出色。
发布如此强大的模型存在风险。如果没有强有力的保障措施,Claude Fable 5 和 Fable 5.1 在网络安全和生物学等领域的先进能力可能被用户滥用,用于发动大规模网络攻击或制造生物武器,可能造成灾难性损害。正因为这些能力,我们之前只向少数经过精心挑选和审查的合作伙伴发布了 Mythos 级模型(如 Mythos Preview)。
认识到这些风险,为了让普通用户能够访问 Fable 5 和 Fable 5.1 的绝大多数能力,我们推出了这些模型,并配备了保障措施,在某些特定领域根据我们的服务条款和使用政策重定向或阻止其响应。自我们首次推出 Claude Fable 5 以来,我们也一直在迭代改进保障措施。
我们正在努力使这些保障措施更加精确,以便仅阻止真正有风险的请求,减少误报。在 Fable 5 或 Fable 5.1 上被这些保障措施阻止的大多数用户查询可能会改为从我们次强大的模型(即"回退")获得响应,该模型可以响应这些类型的查询。
哪些请求可能会回退
Claude Fable 5 和 Fable 5.1 对每个用户请求运行自动安全检查或分类器。这些检查旨在在用户提交以下请求时明显地从 Fable 5 和 Fable 5.1 回退到 Opus 模型:
攻击性网络安全技术,如构建漏洞利用、恶意软件或攻击工具。Claude Fable 5 和 Fable 5.1 可以协助进行常规网络安全任务,但用户应该预期较高的回退率。保障措施旨在阻止访问 Mythos 级能力。
我们认为生物学中具有双重用途的大量查询,如病毒学、毒理学、药物设计和分子设计——因此目前不建议将 Fable 5 和 Fable 5.1 用于专业生物学研究和药物开发。(分类器已更新:2026 年 8 月 6 日在 Claude、Claude 应用和 Claude 平台上,Amazon Bedrock、AWS 上的 Claude 平台、Google Cloud Vertex AI 和 Microsoft Foundry 将随后更新。)
对 Fable 5 和 Fable 5.1 的蒸馏攻击,包括尝试提取模型的总结思考。
一组狭义的前沿大语言模型开发任务,如分布式训练基础设施、机器学习加速器设计和某些非标准芯片的内核开发。
这些阻止保障措施故意设置得很宽泛,我们不断改进保障措施以减少对用户体验的影响。当请求被阻止时,它们可能会回退到非 Mythos 模型,目前生物学、化学和生命科学请求回退到 Opus 5,攻击性网络安全技术请求回退到 Opus 4.8。
检查还会审查模型读取的所有内容,不仅仅是您的最新消息——包括记忆、来自连接器的内容、网络搜索结果和文件,因此可能由您未输入的内容触发阻止。
回退后会发生什么
自动模型切换默认处于活跃状态。当您的请求回退时,Claude 会在同一对话中的 Opus 模型上重新运行被阻止的 Claude Fable 5 或 Fable 5.1 请求。您会看到一条通知,说明模型已切换,响应将标记为回答的模型。Opus 是一个高度能干的模型,具有自己强大的保障措施,对于大多数在 Fable 5 或 Fable 5.1 上被阻止的其他合法请求,Opus 应该能给您一个有帮助的答案。
切换后,模型选择器在对话的其余部分保持在 Opus 上。您可以随时从模型选择器切换回 Claude Fable 5 或 Fable 5.1。
注意:如果在自动模型切换后切换回 Claude Fable 5 或 Fable 5.1,相同的 Fable 5 或 Fable 5.1 保障措施可能会导致 Claude 再次回退,如果您的原始请求仍然是对话的一部分。在重试之前编辑您之前的消息通常会有所帮助。
如果回退请求也被阻止
Opus 有自己的安全系统。要了解 Claude Opus 5 中的回退,请参阅为什么 Claude 在与 Opus 5 的对话中切换了模型。
如果您的请求在功能较弱的模型上也被阻止,您可以编辑您的消息并重试。对于网络安全,如果您的用例具有合法的防御目的并受到这些保障措施的影响,您可以申请 Opus 的网络验证计划 (CVP)。了解更多关于Claude Opus 和 Sonnet 上的实时网络安全保障。
管理自动模型切换
自动切换在您首次选择 Claude Fable 5 或 Fable 5.1 时默认启用。它默认保持启用,您可以随时关闭它:
转到设置 > 功能(或在 Claude Code 中转到配置 > 模型和输出)。
关闭消息被标记时切换模型。
关闭自动模型切换后,被阻止的请求会暂停对话,而不是切换模型。然后您可以:
编辑您的消息并在 Claude Fable 5 或 Fable 5.1 上重试
手动将相同的消息发送到功能较弱的模型
使用和计费
被阻止的请求根据阻止发生的时间以不同方式计费:
Claude 响应前被阻止:为了破坏对我们保障措施的协调攻击,在任何输出之前到达的拒绝在因生物学、蒸馏或前沿大语言模型开发安全分类器而停止或回退时计费。这些是截至 2026 年 9 月我们误报率最低的类别。在其他类别中在任何输出之前被阻止的请求不收费。
Claude 开始响应后被阻止:如果请求在中途被阻止,输入令牌和在阻止前流式传输的令牌按生成它们的模型的费率计费。
回退请求:如果您选择了自动模型切换,并且对话在阻止后切换到 Opus,Opus 响应将按各自模型的费率单独计费。我们在请求时提供信用以补偿回退请求的缓存未命中。
了解更多关于拒绝和回退。
提供反馈
如果您被阻止的请求似乎与上面列出的分类器之一无关,或者您在这些领域的合法工作不断被阻止,请告诉我们。使用"发送反馈"来报告它。关于被错误阻止的请求的报告帮助我们缩小范围并改进这些保障措施。
敬请期待更新
展望未来,我们计划考虑为双重用途网络防御和生物学研究开放配额的方式。随着我们安全系统的成熟,我们的目标是支持合法的生物学和防御性网络安全工作,同时保持强有力的防止滥用的保护。
我们将在计划详情(包括资格和申请方式)可用时分享更多信息。关注此帮助中心以获取更新,或在此注册通知。
自动模型切换适用的地方
自动模型切换在您可以使用 Claude Fable 5 和 Fable 5.1 的任何地方都以相同的方式工作:
网页版 Claude
Claude 移动应用
Claude 桌面版
Claude Cowork
Claude Code
Claude Design
Claude for Microsoft 365
Claude Tag
重要:如果您使用 Claude API,模型切换的工作方式不同。自动切换默认不活跃,API 客户必须选择加入并配置回退。在配置回退之前,模型将在 API 上返回带有停止原因的 200 响应。有关详细信息,请参阅开发者文档。
阅读我们的博客以了解更多关于Claude Fable 5 和 Claude Mythos 5。
我们的保障措施旨在与模型的能力相匹配。有关 Claude Opus 5 上的保障措施如何工作,请参阅为什么 Claude 在与 Opus 5 的对话中切换了模型。
