メインコンテンツにスキップ

保護された思考:メッセージAPIが思考ブロックを処理する方法を変更して蒸留から保護

メッセージAPIが思考ブロックを処理する方法を変更して、蒸留から保護します。思考ブロックは、Claudeが応答に取り組む際に生成する可能性のある推論の記録です。Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5では、新しいAPIアカウントは、マルチターン会話中に思考ブロックの周囲のコンテキスト(メッセージ、ツール、システムプロンプトなど)を編集できなくなります。今後のモデル起動により、すべてのユーザーへのロールアウトを拡大します。

この前のコンテキストを変更することは正当な用途があり、以下に概説する調整を使用して引き続きサポートしています。ただし、このような変更は、産業規模の違法な蒸留の一般的で公開されている技術でもあり、当社の利用ポリシーおよび利用規約で禁止されています。

現在、APIは思考ブロックがそれを生成したのと同じシステムプロンプト、ツール、メッセージで送り返されることを確認し、一致しない場合はエラーを返します。変更されたリクエストを成功させるために、開発者は代わりに思考ブロックをそのようなリクエストから削除することを選択できます。モデルは思考ブロックを見ずに応答します。

この記事では、これを行う理由と、中断を最小限に抑えるために実施できる調整の詳細を共有します。

思考ブロックとは何ですか?

Claudeは最終的な答えを提供する前に推論ステップを生成します。APIでは、これらは「思考ブロック」としてユーザーに返されます。マルチターン会話では、APIユーザーはこれらのブロックを各交換で(システムプロンプト、ツール、および以前のメッセージとともに)送り返すため、Claudeは完全な会話コンテキストを持ちます。

何が変わりますか?

以下にリストされているモデルを使用する影響を受けるアカウントの場合、以前の思考ブロックの前のシステムプロンプト、ツール、またはメッセージが変更されている場合、APIはエラーを返します。

エラーメッセージを回避するために、「非厳密」モードにオプトインできます。このモードでは、リクエストは通過しますが、影響を受けた思考ブロックはモデルが見るものから削除されます。これにより、以前のターンの思考がモデルに表示されていないにもかかわらず、会話またはタスクを中断なく続行できます。これが発生すると、APIレスポンスはどのブロックが削除されたかを通知します。

なぜこの変更を行っているのですか?

会話の以前のターンを変更することは、違法な蒸留キャンペーンで使用される一般的な技術であり、認可なしに高度なモデル(特に思考)の機能を抽出して別のモデルをトレーニングすることを目的としています。蒸留は、多くの場合、数千の偽のアカウントを使用して産業規模で採用されます。Claudeの思考ブロックを暗号化して蒸留を防ぎますが、思考ブロックの前に会話を編集することで、ユーザーはClaudeに推論を復号化して出力させることができます。このようにトレーニングされたシステムは、本来は持たない機能を継承できますが、サイバー攻撃や兵器開発など、幅広い悪用を防ぐために構築したセーフガードは継承しません。

この変更は、蒸留キャンペーンの実行をより困難にすることを目的としています。強化された蒸留分類器やより高度なモデルからより低い機能を持つモデルへのセッションまたは推論の転送に関する制限など、既存の反蒸留対策に基づいています。

これはAPIインテグレーションにとって何を意味しますか?

特に会話の途中で以前のターンを書き直すことを含むインテグレーション(コンテキスト圧縮、注入されたシステムリマインダー、セッション中のツール変更など)は調整が必要な場合があります。

このアップデートをガイドするのに役立つリソースは次のとおりです:

  • 保護された思考ドキュメントは、変更が適用される場所、インテグレーションが影響を受けているかどうかを確認する方法、および保護された思考を破壊せずに一般的な編集を行う方法をカバーしています。

  • 圧縮(ベータ版)は古いターンを要約しながら最新のターンを単語ごとに保持でき、エージェントが作業を続けている間にバックグラウンドで要約を構築できます。インテグレーションが変更する必要がある最も一般的な理由であるクライアント側の圧縮に代わります。

  • 会話中のツール変更(ベータ版)を使用すると、以前のターンを編集せずに会話中にツールを追加または削除できます。

  • 当社の移行ガイドには、各モデルへの移行に関する完全なチェックリストがあります。

Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundryでの可用性については、各ページを確認してください。

上記のガイダンスがユースケースをカバーしていない場合は、サポートチームにお問い合わせください。アカウントチームと協力している場合は、より複雑なインテグレーションの更新をサポートするために、彼らに連絡することもできます。

思考ブロックを一貫性のあるものに保つことには追加の利点があります。APIがキャッシュされたプロンプトをより頻繁に再利用できるため、コストと応答時間が削減されます。

これは誰に影響を与えますか?

保護された思考は、これらのモデルとアカウントに適用されます:

モデル

2026年8月31日以降に作成されたAPIアカウント(00:00 UTC)

その前に作成されたアカウント

Claude Fable 5.1

適用

適用されない

Claude Opus 5.5

適用

適用されない

Claude Sonnet 5.5

適用

適用されない

これは、Claude Platformの組織、Amazon Bedrockアカウント、Google Cloud Vertex AIプロジェクト、およびMicrosoft Foundryプロジェクトをカバーしています。

段階的な実施アプローチを採用しており、蒸留関連の悪用の最も高い濃度が見られる新しいアカウントから始めています。これにより、既存のアカウントを持つ開発者は、ハーネスとインテグレーションを互換性のあるものにする時間が与えられます。

Claude Code、Claude Cowork、またはClaude.aiを使用している場合、変更する必要はありません。これらの製品は思考ブロックを処理します。

思考は、それを作成したアカウントによってのみ読み取ることができます

Claude Sonnet 5.5から始まり、思考ブロックはそれを作成したアカウント、またはそれにリンクされたアカウントによってのみ読み取ることができます。

思考ブロックには個人情報が含まれる可能性があります。暗号化されているため、トランスクリプトを検査するときにその情報は表示されません。このチェックは、共有またはリークされたトランスクリプトが内部の推論を公開するのを防ぐのに役立ちます。また、蒸留者がそれを生成したアカウントを禁止した後、収穫されたトランスクリプトを新しいアカウントに移動することを困難にします。

リクエストにリンクされていないアカウントからの思考が含まれている場合、APIはその思考を削除し、リクエストは続行されます。エラーは返されません。次のレスポンスは遅くなり、圧縮と同様により多くのトークンを使用する可能性があります。

同じClaudeプラットフォーム親組織または同じGoogle Cloud組織内のアカウントは自動的にリンクされます。たとえば、Claude PlatformとAmazon Bedrockの間でフェイルオーバーするために、他のアカウント間で会話を続ける場合は、アカウントチームに連絡してそれらをリンクしてください。

Claude Codeでは、セッションの途中でアカウントを切り替えると、同じ効果があります。次のレスポンスは遅くなり、より多くのトークンを使用します。

こちらの回答で解決しましたか?