Avec Claude Fable 5.1, nous modifions la façon dont l'API Messages gère les blocs de pensée pour se protéger contre la distillation. Un bloc de pensée est un enregistrement du raisonnement que Claude peut produire en travaillant sur une réponse. Les nouveaux comptes API pour Fable 5.1 ne pourront plus modifier le contexte autour d'un bloc de pensée, comme les messages, les outils ou l'invite système, lors d'une conversation multi-tours.
La modification de ce contexte antérieur a des applications légitimes, que nous continuons à soutenir en utilisant les ajustements décrits ci-dessous. Cependant, ces modifications sont aussi une technique courante et documentée publiquement pour la distillation illicite à l'échelle industrielle, qui est interdite par notre Politique d'utilisation et nos Conditions de service.
Voici ce qui change : l'API vérifiera désormais qu'un bloc de pensée est renvoyé avec le même invite système, les mêmes outils et les mêmes messages qui l'ont produit, et retournera une erreur s'ils ne correspondent pas. Pour que les demandes modifiées réussissent, les développeurs peuvent choisir de faire supprimer les blocs de pensée de ces demandes ; le modèle répondra sans voir le bloc de pensée. Pour Fable 5.1, la pensée préservée s'applique uniquement aux nouveaux comptes API, bien que cette mise à jour s'appliquera à tous les comptes dans les futures versions de modèles.
Dans cet article, nous partageons les détails sur les raisons pour lesquelles nous faisons cela et les ajustements que vous pouvez apporter pour minimiser les perturbations.
Que sont les blocs de pensée ?
Claude produit des étapes de raisonnement avant de fournir sa réponse finale. Sur l'API, celles-ci sont retournées à l'utilisateur sous forme de « blocs de pensée ». Dans une conversation multi-tours, les utilisateurs de l'API renvoient ces blocs avec chaque échange (ainsi que l'invite système, les outils et les messages antérieurs), afin que Claude dispose du contexte conversationnel complet.
Qu'est-ce qui change ?
Pour les comptes affectés (voir ci-dessous) sur Fable 5.1, l'API retournera une erreur si l'invite système, les outils ou les messages précédant un bloc de pensée antérieur ont été modifiés.
Pour éviter un message d'erreur, vous pouvez opter pour le mode « non strict ». Dans ce mode, la demande sera traitée, mais les blocs de pensée affectés seront supprimés de ce que le modèle voit. Cela vous permet de continuer votre conversation ou tâche sans interruption malgré le fait que la pensée des tours précédents ne soit pas montrée au modèle. Quand cela se produit, la réponse de l'API vous indiquera quels blocs ont été supprimés.
Pourquoi apportons-nous ce changement ?
Modifier les tours antérieurs d'une conversation est une technique courante utilisée dans les campagnes de distillation illicite, qui visent à extraire les capacités de modèles avancés—en particulier la pensée—pour entraîner un autre modèle, sans autorisation. La distillation est souvent employée à l'échelle industrielle, en utilisant des milliers de faux comptes. Nous chiffrons les blocs de pensée de Claude pour prévenir cela, mais en modifiant la conversation avant un bloc de pensée, un utilisateur pourrait amener Claude à déchiffrer et imprimer son raisonnement. Les systèmes entraînés de cette façon peuvent hériter de capacités qu'ils n'auraient pas autrement, sans hériter des protections que nous avons mises en place pour prévenir un large éventail d'abus comme les cyberattaques et le développement d'armes.
Ce changement vise à rendre les campagnes de distillation plus difficiles à exécuter. Il s'appuie sur les mesures anti-distillation existantes comme les classificateurs de distillation améliorés et les restrictions sur le transfert de sessions ou de raisonnement de modèles plus avancés vers des modèles moins capables avec des protections plus faibles.
Qu'est-ce que cela signifie pour les intégrations API ?
Certaines intégrations—en particulier celles qui impliquent la réécriture des tours antérieurs en milieu de conversation, comme la compaction de contexte et les rappels système injectés—peuvent nécessiter un ajustement.
Voici les ressources pour vous aider à naviguer cette mise à jour :
La documentation sur la pensée préservée couvre où le changement s'applique et ne s'applique pas.
Le guide de migration Fable 5.1 contient une liste de contrôle complète pour les mises à jour nécessaires.
Le guide d'invite Fable 5.1 couvre les différences comportementales et les modèles d'invite qui vous aident à exploiter les capacités complètes de Fable 5.1.
Si les conseils ci-dessus ne couvrent pas votre cas d'usage, veuillez contacter notre équipe d'assistance. Si vous travaillez avec une équipe de compte, vous pouvez également les contacter pour obtenir de l'aide pour mettre à jour les intégrations plus complexes.
Il y a des avantages supplémentaires à maintenir les blocs de pensée cohérents : cela signifie que l'API peut réutiliser les invites en cache plus souvent, ce qui réduit les coûts et le temps de réponse.
Qui cela affectera-t-il ?
Sur Fable 5.1, cette mise à jour s'applique aux nouveaux comptes API créés après le 31 août 2026 12:00:00 AM UTC. Plus précisément, elle affecte les nouvelles organisations Claude Platform, les comptes Amazon Bedrock, les projets Google Cloud Vertex AI et les projets Microsoft Azure Foundry créés le 31 août 2026 ou après.
Nous adoptons une approche progressive de l'application, en commençant par les nouveaux comptes, où nous voyons la plus forte concentration d'abus liés à la distillation. Les comptes existants ne seront pas affectés pour Fable 5.1, ce qui donne aux développeurs le temps de rendre leurs harnais et intégrations compatibles avec cette mise à jour. La pensée préservée s'appliquera à tous les utilisateurs pour les futurs modèles.
Les utilisateurs de Claude Code, Claude Cowork, Claude.ai ou Claude via un produit tiers ne sont pas affectés, pas plus que l'utilisation de modèles autres que Fable 5.1.
