Nous modifions la gestion des blocs de réflexion par l'API Messages pour nous protéger contre la distillation. Un bloc de réflexion est un enregistrement du raisonnement que Claude peut produire en travaillant sur une réponse. Sur Claude Fable 5.1, Claude Opus 5.5 et Claude Sonnet 5.5, les nouveaux comptes API ne peuvent plus modifier le contexte autour d'un bloc de réflexion, comme les messages, les outils ou l'invite système, lors d'une conversation multi-tours. Nous étendrons le déploiement à tous les utilisateurs avec les prochains lancements de modèles.
Modifier ce contexte antérieur a des applications légitimes, que nous continuons à soutenir en utilisant les ajustements décrits ci-dessous. Cependant, ces modifications sont aussi une technique courante et documentée publiquement pour la distillation illicite à l'échelle industrielle, qui est interdite par notre Politique d'utilisation et nos Conditions de service.
Désormais, l'API vérifiera qu'un bloc de réflexion est renvoyé avec le même invite système, les mêmes outils et les mêmes messages qui l'ont produit, et retournera une erreur s'ils ne correspondent pas. Pour que les demandes modifiées réussissent, les développeurs peuvent choisir de faire supprimer les blocs de réflexion de ces demandes ; le modèle répondra sans voir le bloc de réflexion.
Dans cet article, nous partageons les détails sur les raisons pour lesquelles nous faisons cela et les ajustements que vous pouvez apporter pour minimiser les perturbations.
Qu'est-ce que les blocs de réflexion ?
Claude produit des étapes de raisonnement avant de fournir sa réponse finale. Sur l'API, celles-ci sont retournées à l'utilisateur sous forme de « blocs de réflexion ». Dans une conversation multi-tours, les utilisateurs de l'API renvoient ces blocs avec chaque échange (ainsi que l'invite système, les outils et les messages antérieurs), afin que Claude dispose du contexte conversationnel complet.
Qu'est-ce qui change ?
Pour les comptes affectés utilisant les modèles énumérés ci-dessous, l'API retournera une erreur si l'invite système, les outils ou les messages précédant un bloc de réflexion antérieur ont été modifiés.
Pour éviter un message d'erreur, vous pouvez opter pour le mode « non strict ». Dans ce mode, la demande passera, mais les blocs de réflexion affectés seront supprimés de ce que le modèle voit. Cela vous permet de continuer votre conversation ou tâche sans interruption malgré le fait que la réflexion des tours précédents ne soit pas montrée au modèle. Quand cela se produit, la réponse de l'API vous indique quels blocs ont été supprimés.
Pourquoi apportons-nous ce changement ?
Modifier les tours antérieurs d'une conversation est une technique courante utilisée dans les campagnes de distillation illicite, qui visent à extraire les capacités des modèles avancés, en particulier la réflexion, pour entraîner un autre modèle, sans autorisation. La distillation est souvent employée à l'échelle industrielle, en utilisant des milliers de faux comptes. Nous chiffrons les blocs de réflexion de Claude pour prévenir cela, mais en modifiant la conversation avant un bloc de réflexion, un utilisateur pourrait amener Claude à déchiffrer et imprimer son raisonnement. Les systèmes entraînés de cette manière peuvent hériter de capacités qu'ils n'auraient pas autrement, sans hériter des protections que nous avons mises en place pour prévenir un large éventail d'abus comme les cyberattaques et le développement d'armes.
Ce changement vise à rendre les campagnes de distillation plus difficiles à exécuter. Il s'appuie sur les mesures anti-distillation existantes comme les classificateurs de distillation améliorés et les restrictions sur le transfert de sessions ou de raisonnement des modèles plus avancés aux modèles moins capables avec des protections plus faibles.
Qu'est-ce que cela signifie pour les intégrations API ?
Certaines intégrations, en particulier celles qui impliquent de réécrire les tours antérieurs au milieu d'une conversation, comme la compaction de contexte, les rappels système injectés ou la modification des outils en milieu de session, peuvent nécessiter un ajustement.
Voici les ressources pour vous aider à naviguer cette mise à jour :
La documentation sur la réflexion préservée couvre où le changement s'applique, comment vérifier si votre intégration est affectée, et comment effectuer les modifications courantes sans casser la réflexion préservée.
La Compaction (bêta) peut résumer les tours plus anciens tout en gardant les tours les plus récents mot pour mot, et peut construire le résumé en arrière-plan pendant que votre agent continue de travailler. Elle remplace la compaction côté client, qui est probablement la raison la plus courante pour laquelle les intégrations doivent changer.
Les modifications d'outils en milieu de conversation (bêta) vous permettent d'ajouter ou de supprimer des outils lors d'une conversation sans modifier les tours antérieurs.
Nos guides de migration contiennent une liste de contrôle complète pour migrer vers chaque modèle.
Vérifiez chaque page pour la disponibilité sur Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry.
Si les conseils ci-dessus ne couvrent pas votre cas d'usage, veuillez contacter notre équipe d'assistance. Si vous travaillez avec une équipe de compte, vous pouvez également les contacter pour obtenir de l'aide pour mettre à jour les intégrations plus complexes.
Il y a des avantages supplémentaires à garder les blocs de réflexion cohérents : cela signifie que l'API peut réutiliser les invites en cache plus souvent, ce qui réduit les coûts et le temps de réponse.
Qui cela affectera-t-il ?
La réflexion préservée s'applique à ces modèles et comptes :
Modèle | Comptes API créés le 31 août 2026 ou après (00:00 UTC) | Comptes créés avant cette date |
Claude Fable 5.1 | S'applique | Ne s'applique pas |
Claude Opus 5.5 | S'applique | Ne s'applique pas |
Claude Sonnet 5.5 | S'applique | Ne s'applique pas |
Cela couvre les organisations Claude Platform, les comptes Amazon Bedrock, les projets Google Cloud Vertex AI et les projets Microsoft Foundry.
Nous adoptons une approche progressive de l'application, en commençant par les nouveaux comptes, où nous voyons la plus forte concentration d'abus liés à la distillation. Cela donne aux développeurs avec des comptes existants le temps de rendre leurs harnais et intégrations compatibles.
Si vous utilisez Claude Code, Claude Cowork ou Claude.ai, il n'y a rien que vous ayez besoin de changer ; ces produits gèrent les blocs de réflexion pour vous.
La réflexion ne peut être lue que par le compte qui l'a créée
À partir de Claude Sonnet 5.5, un bloc de réflexion ne peut être lu que par le compte qui l'a créé, ou par un compte qui lui est lié.
Les blocs de réflexion peuvent contenir des informations privées. Parce qu'ils sont chiffrés, ces informations ne sont pas visibles lorsque vous inspectez une transcription. Cette vérification aide à empêcher une transcription partagée ou divulguée d'exposer le raisonnement à l'intérieur. Cela rend également plus difficile pour les distillateurs de déplacer les transcriptions récoltées vers de nouveaux comptes après que nous ayons banni le compte qui les a produites.
Si une demande inclut une réflexion d'un compte qui n'est pas lié, l'API supprime cette réflexion et la demande continue. Elle ne retourne pas d'erreur. La réponse suivante peut être plus lente et utiliser plus de jetons, similaire à une compaction.
Les comptes dans la même organisation parent Claude Platform ou la même organisation Google Cloud sont liés automatiquement. Si vous continuez les conversations entre d'autres comptes, par exemple pour basculer entre Claude Platform et Amazon Bedrock, contactez votre équipe de compte pour les lier.
Dans Claude Code, le changement de compte au milieu d'une session a le même effet : la réponse suivante est plus lente et utilise plus de jetons.
