跳转到主要内容

为什么Claude在与Sonnet 5.5的对话中切换了模型

本文解释了为什么请求可能会回退到另一个模型或在Claude Sonnet 5.5上被阻止,当您的聊天切换模型时会发生什么,以及如何管理自动切换。

为什么某些请求被阻止

由于其网络安全功能比Claude Sonnet 5有了实质性的提升,Claude Sonnet 5.5是第一个具有网络安全回退功能的Sonnet模型,类似于我们为最强大的模型开发的功能。其生物学防护措施与Sonnet 5相同。两种防护措施都针对一小部分高风险请求;常规软件开发和大多数生命科学工作不受影响。

发送到Sonnet 5.5的大多数请求不会遇到这些防护措施。一小部分高风险请求要么回退到Sonnet 5,要么被直接阻止,这样我们可以继续支持日常工作,同时限制滥用风险。我们继续改进这些防护措施,使其阻止更少的合法请求,包括微调我们的分类器以减少误报。您的反馈有助于指导这项工作。

哪些请求可能被回退或阻止

Sonnet 5.5对每个请求运行自动安全检查或分类器。这些检查也会审查模型读取的所有内容,而不仅仅是您的最新消息。这包括记忆、来自连接器的内容、网络搜索结果和文件,因此回退或阻止可能由您未输入的内容触发。

回退和阻止的工作方式取决于触发的分类器类型:网络安全、生物学、大语言模型开发或蒸馏。

网络安全

当我们的网络安全分类器标记潜在的高风险攻击性网络安全请求时,Sonnet 5.5可能会回退到Claude Sonnet 5,例如:

  • 漏洞利用生成

  • 基于二进制的漏洞扫描

  • 渗透测试

您仍然可以将Sonnet 5.5用于安全编码用例,例如扫描源代码以查找漏洞。

生物学

Sonnet 5.5阻止可能帮助某人造成严重生物伤害的请求。生物学阻止不会回退到另一个模型,请求被直接阻止。

Sonnet 5.5使用与Sonnet 5相同的生物学防护措施。这些措施针对有害请求;大多数研究、教育和临床工作不受影响,尽管某些微生物学和病毒学请求可能被错误地标记。组织可以申请我们的生命科学验证计划,以获得为生物学相关工作的全部范围设计的防护措施。

前沿大语言模型开发

Sonnet 5.5具有与开发最先进的大语言模型相关的一小部分功能的分类器,例如某些机器学习加速器的内核开发。它们不应该影响绝大多数传统人工智能或机器学习开发、研究或通用编码。当这些分类器标记请求时,Claude从Sonnet 5.5回退到Sonnet 5。

蒸馏

Sonnet 5.5具有检测和直接阻止尝试提取模型内部推理的分类器。蒸馏阻止不会回退到另一个模型,请求被直接阻止。

被阻止的请求示例包括要求Claude逐字重复其推理或将其完整思维链写入外部输出的提示。您仍然可以要求Claude解释其推理、教您一个概念或逐步进行代码审查。诸如"你为什么这样做?"之类的对话请求不受影响。

回退后会发生什么

自动模型切换默认处于活动状态。当您的请求回退时,Claude在同一对话中的Sonnet 5上重新运行它。所有回退都是透明的,这意味着您会看到一条通知,说明模型已切换,响应会标记为回答的模型。

切换后,模型选择器在聊天的其余部分保持在Sonnet 5上。您可以随时从模型选择器切换回Sonnet 5.5。

注意:如果在自动模型切换后切换回Sonnet 5.5,如果您的原始请求仍然是对话的一部分,相同的防护措施可能会导致Claude再次回退。在重试之前编辑您的上一条消息通常会有所帮助。

如果回退请求也被阻止

Sonnet 5有自己的安全系统。如果您的请求也在Sonnet 5上被阻止,您可以编辑您的消息并重试。

对于生物学,如果您的组织进行合法的生命科学研究并受到这些防护措施的影响,您可以申请生命科学验证计划(LSVP)以获得扩展功能。在Sonnet 5.5上,LSVP仅通过高风险使用附加组件放宽生物学防护措施。在我们的博客中了解更多信息:推出生命科学验证计划。

Sonnet 5.5在推出时在网络安全验证计划中不可用。很快,网络防御者将能够申请我们扩展的网络安全验证计划,以获得对Sonnet 5.5上更高级功能的分层访问。

注意:Claude Sonnet 5.5与零数据保留(ZDR)兼容。

管理自动模型切换

自动切换默认为Sonnet 5.5启用,您可以随时关闭它:

  1. 转到设置 > 功能(或在Claude Code中转到配置 > 模型和输出)。

  2. 关闭当消息被标记时切换模型。

关闭自动模型切换后,回退的请求会暂停聊天而不是切换模型。然后您可以:

  • 编辑您的消息并在Sonnet 5.5上重试

  • 手动将相同的消息发送到不同的模型

使用和计费

回退或被阻止的请求如何计费取决于阻止发生的时间和触发它的分类器:

  • Claude响应前被阻止:为了破坏对我们防护措施的协调攻击,在任何输出之前到达的拒绝在由生物学、蒸馏或大语言模型开发安全分类器停止或回退时计费。在其他类别中在任何输出之前被阻止的请求不收费。

  • Claude开始响应后被阻止:如果请求在中途被阻止,输入令牌和在阻止前流式传输的令牌按生成它们的模型的费率计费。

  • 回退请求:如果您选择了自动模型切换,聊天在阻止后切换到Sonnet 5,Sonnet 5响应将单独计费,按Sonnet 5的费率。我们提供信用以补偿回退请求的缓存未命中。

了解更多关于拒绝和回退。

提供反馈

如果您的请求被阻止但似乎与上面列出的分类器之一无关,或者您的合法工作不断回退,请告诉我们。使用"发送反馈"来报告它。关于被错误阻止的请求的报告有助于我们缩小和改进这些防护措施。

自动模型切换适用的位置

自动模型切换在您可以使用Claude Sonnet 5.5的任何地方都以相同的方式工作:

  • 网页版Claude

  • Claude Mobile

  • Claude Desktop

  • Claude Cowork

  • Claude Code

  • Claude Design

  • Claude for Microsoft 365

  • Claude Tag

  • Claude Science

重要:如果您使用Claude API,模型切换的工作方式不同。自动切换默认不处于活动状态,API客户必须选择加入并配置回退。在配置回退之前,模型在API上返回200响应,停止原因。有关详细信息,请参阅开发者文档。

阅读我们的博客以了解更多关于Claude Sonnet 5.5。

我们的防护措施旨在与模型的功能相匹配。

有关Claude Opus 5.5上的防护措施如何工作,请参阅为什么Claude在与Opus 5或Opus 5.5的对话中切换了模型。对于Claude Fable 5.1,请参阅为什么Claude在与Fable 5或Fable 5.1的对话中切换了模型。

这是否解答了您的问题?