跳转到主要内容

保留思考:改变Messages API处理思考块的方式以防止蒸馏

通过Claude Fable 5.1,我们改变了Messages API处理思考块的方式以防止蒸馏。思考块是Claude在处理响应时可能产生的推理记录。Fable 5.1的新API账户将不再能够在多轮对话中编辑思考块周围的上下文,例如消息、工具或系统提示。

修改这些先前的上下文有合法的应用,我们继续通过下面列出的调整来支持这些应用。但是,这样的修改也是工业规模非法蒸馏的常见且公开记录的技术,这被我们的使用政策和服务条款所禁止。

以下是变化:API现在将验证思考块是否与产生它的相同系统提示、工具和消息一起发送回来,如果不匹配将返回错误。为了使修改后的请求成功,开发者可以选择改为从这些请求中删除思考块;模型将在不看到思考块的情况下做出响应。对于Fable 5.1,保留思考仅适用于新API账户,尽管此更新将在未来的模型版本中适用于所有账户。

在本文中,我们分享了我们这样做的原因的详细信息以及您可以进行的调整以最小化中断。

什么是思考块?

Claude在提供最终答案之前会产生推理步骤。在API上,这些以"思考块"的形式返回给用户。在多轮对话中,API用户在每次交换时将这些块与系统提示、工具和早期消息一起发送回来,以便Claude拥有完整的对话上下文。

什么在改变?

对于Fable 5.1上受影响的账户(见下文),如果先前思考块之前的系统提示、工具或消息已被修改,API将返回错误。

为了避免错误消息,您可以选择加入"非严格"模式。在此模式下,请求将通过,但受影响的思考块将从模型看到的内容中删除。这允许您继续对话或任务而不中断,尽管先前轮次的思考不会显示给模型。发生这种情况时,API响应将告诉您删除了哪些块。

我们为什么要做出这个改变?

改变对话的早期轮次是非法蒸馏活动中使用的常见技术,这些活动旨在提取高级模型的能力——尤其是思考——来训练另一个模型,未经授权。蒸馏通常在工业规模上进行,使用数千个虚假账户。我们加密Claude的思考块以防止这种情况,但通过在思考块之前编辑对话,用户可以让Claude解密并打印其推理。以这种方式训练的系统可以继承它们本来不会拥有的能力,而不会继承我们为防止广泛滥用(如网络攻击和武器开发)而建立的保障措施。

此更改旨在使蒸馏活动更难执行。它建立在现有的反蒸馏措施之上,例如增强的蒸馏分类器以及限制从更高级模型向具有较弱保障的较低能力模型转移会话或推理。

这对API集成意味着什么?

某些集成——特别是那些涉及在对话中途重写早期轮次的集成,如上下文压缩和注入的系统提醒——可能需要调整。

以下是帮助您完成此更新的资源:

如果上述指导不涵盖您的用例,请联系我们的支持团队。如果您与账户团队合作,您也可以联系他们以获得更新更复杂集成的支持。

保持思考块一致还有额外的好处:这意味着API可以更频繁地重用缓存的提示,从而降低成本和响应时间。

这将影响谁?

在Fable 5.1上,此更新适用于2026年8月31日12:00:00 AM UTC之后创建的新API账户。具体来说,它影响2026年8月31日或之后创建的新Claude Platform组织、Amazon Bedrock账户、Google Cloud Vertex AI项目和Microsoft Azure Foundry项目。

我们采取分阶段的执行方法,从新账户开始,我们在这些账户中看到最高浓度的蒸馏相关滥用。现有账户在Fable 5.1上不会受到影响,这给开发者时间使他们的测试框架和集成与此更新兼容。保留思考将在未来的模型中适用于所有用户。

Claude Code、Claude Cowork、Claude.ai或通过第三方产品使用Claude的用户受影响,Fable 5.1以外的模型使用也不受影响。

这是否解答了您的问题?