跳转到主要内容

为什么 Claude 在与 Opus 5 或 Opus 5.5 的对话中切换了模型

本文解释了为什么请求可能会回退到 Claude Opus 5 或 Opus 5.5、对话切换到另一个模型时会发生什么,以及如何管理自动切换。

为什么某些请求被阻止

Claude Opus 5 和 Opus 5.5 在各个方面都改进了 Claude Opus 4.8。我们已根据这些能力提升调整了其安全防护措施。

发送到 Opus 5 或 Opus 5.5 的大多数请求不会遇到回退安全干预。一小部分高风险请求要么回退到功能较弱的模型,要么被直接阻止,这样我们可以继续支持日常工作,同时限制滥用风险。我们继续努力完善这些安全防护措施,以减少对合法请求的阻止。这包括微调我们的分类器以减少误报,以及考虑一系列账户信任信号。您的反馈有助于指导这项工作。

哪些请求可能会回退或被阻止

Claude Opus 5 和 Opus 5.5 对每个用户请求运行自动安全检查(即分类器)。这些检查还会审查模型读取的所有内容,而不仅仅是您的最新消息。这包括记忆、来自连接器的内容、网络搜索结果和文件,因此回退可能由您未输入的内容触发。

回退和阻止的工作方式取决于触发的分类器类型:网络安全、生物学、前沿 LLM 开发或蒸馏。

网络安全

当我们的网络安全分类器标记潜在的高风险攻击性网络安全请求时,Opus 5 或 Opus 5.5 可能会回退到 Opus 4.8,例如:

  • 漏洞利用生成

  • 基于二进制的漏洞扫描

  • 渗透测试

您仍然可以使用 Opus 5 和 Opus 5.5 进行安全编码,包括扫描源代码中的漏洞、分类安全问题和构建安全代码。

生物学

虽然 Claude Opus 5 在生物学方面改进了 Opus 4.8,但在可能导致重大风险的新颖研究发现的真实长期任务方面,它不如 Fable 5 强大。因此,Opus 5 不会在生物学、化学或生命科学问题上回退。它对这些主题使用与 Opus 4.8 类似的安全防护措施。

由于 Opus 5.5 相比 Opus 5 的能力提升,Opus 5.5 具有与 Claude Fable 5 类似的生物学安全分类器。当您在病毒学、毒理学和分子设计等领域提交双用途请求时,这些分类器会导致 Claude 从 Opus 5.5 回退到 Opus 5。您仍然可以使用 Opus 5.5 进行日常健康和教育问题,包括解释实验室结果、理解症状和学习生物学。

前沿 LLM 开发(仅限 Opus 5.5)

Opus 5.5 具有与 Fable 模型类似的分类器,用于与前沿 LLM 开发相关的一小部分能力,例如某些 ML 加速器的内核开发。它们不应该影响绝大多数传统 AI 或 ML 开发、研究或通用编码。这些分类器会导致 Claude 从 Opus 5.5 回退到 Opus 5。

注意:这些前沿 LLM 开发分类器仅适用于 Opus 5.5。Opus 5 不会在前沿 LLM 开发问题上回退。

蒸馏

Opus 5 和 Opus 5.5 具有检测和直接阻止尝试提取模型内部推理的分类器。蒸馏阻止不会回退到另一个模型,请求会被直接阻止。

被阻止的请求示例包括要求 Claude 逐字重复其推理或将其完整思维链写入外部输出的提示。您仍然可以要求 Claude 解释其推理、教您一个概念或逐步进行代码审查。"为什么你这样做?"之类的对话请求不受影响。

回退后会发生什么

自动模型切换默认处于活跃状态。当您的请求回退时,Claude 会在同一对话中的功能较弱的模型上重新运行您被阻止的请求。所有回退都是透明的,这意味着您会看到一条通知,说明模型已切换,响应将标记为回答的模型。

切换后,模型选择器在对话的其余部分保持在功能较弱的模型上。您可以随时从模型选择器切换回 Opus 5 或 Opus 5.5。

注意:如果在自动模型切换后切换回 Opus 5 或 Opus 5.5,如果您的原始请求仍然是对话的一部分,相同的安全防护措施可能会导致 Claude 再次回退。在重试之前编辑您的上一条消息通常会有所帮助。

如果回退请求也被阻止

Opus 4.8 有自己的安全系统。如果您的请求在 Opus 4.8 上也被阻止,您可以编辑您的消息并重试。

对于网络安全,如果您的用例具有合法的防御目的并受到这些安全防护措施的影响,您可以申请网络安全验证计划 (CVP)。了解更多关于 Claude Opus 和 Sonnet 上的实时网络安全防护。

对于生物学,如果您的组织进行合法的生命科学研究并受到这些安全防护措施的影响,您可以申请生命科学验证计划 (LSVP)。LSVP 为经过验证的生命科学组织提供对 Claude 最强大模型的访问权限,用于内部研究和开发。在我们的博客中了解更多信息:推出生命科学验证计划。

注意:Opus 5.5 目前在网络安全验证计划中不可用。如果您的组织已通过网络安全验证计划使用 Opus 4.8,现在可以访问具有较少网络安全限制的 Opus 5。Opus 5 也与零数据保留兼容。

管理自动模型切换

首次选择 Claude Opus 5 或 Opus 5.5 时,自动切换默认启用。它默认保持启用,您可以随时关闭它:

  1. 转到 设置 > 功能(或 Claude Code 中的 配置 > 模型和输出)。

  2. 关闭 消息被标记时切换模型。

关闭自动模型切换后,回退的请求会暂停对话,而不是切换模型。然后您可以:

  • 编辑您的消息并在 Opus 5 或 Opus 5.5 上重试

  • 手动将相同的消息发送到功能较弱的模型

使用和计费

回退的请求如何计费取决于阻止发生的时间和触发的分类器:

  • Claude 响应前被阻止:为了破坏对我们安全防护措施的协调攻击,在任何输出之前到达的拒绝在因生物学、蒸馏或前沿 LLM 开发安全分类器而停止或回退时计费。这些是截至 2026 年 9 月我们误报率最低的类别。在其他类别中在任何输出之前被阻止的请求不收费。

  • Claude 开始响应后被阻止:如果请求在中途被阻止,输入令牌和在阻止前流式传输的令牌按生成它们的模型的费率计费。

  • 回退请求:如果您选择了自动模型切换,并且在阻止后对话切换到另一个模型,回退响应将单独计费,按响应模型的费率计费。我们提供信用以补偿回退请求的缓存未命中。

了解更多关于 拒绝和回退。

提供反馈

如果您的请求被阻止,但似乎与上面列出的分类器之一无关,或者您的合法安全工作不断回退,请告诉我们。使用"发送反馈"来报告它。关于被错误阻止的请求的报告有助于我们缩小和改进这些安全防护措施。

自动模型切换适用的位置

自动模型切换在您可以使用 Claude Opus 5 或 Opus 5.5 的任何地方都以相同的方式工作:

  • 网页版 Claude

  • Claude 移动应用

  • Claude 桌面版

  • Claude Cowork

  • Claude Code

  • Claude Design

  • Claude for Microsoft 365

  • Claude Tag

  • Claude Science

重要:如果您使用 Claude API,模型切换的工作方式不同。自动切换默认不活跃,API 客户必须选择加入并配置回退。在配置回退之前,模型将在 API 上返回带有停止原因的 200 响应。有关详细信息,请参阅 开发者文档。

阅读我们的博客以了解更多关于 Claude Opus 5 和 Claude Opus 5.5。

我们的安全防护措施旨在与模型的能力相匹配。有关安全防护措施如何在 Claude Fable 5 上工作的信息,请参阅 为什么 Claude 在与 Fable 5 的对话中切换了模型。

这是否解答了您的问题?