メインコンテンツにスキップ

ClaudeがAI生成コンテンツをマークする方法

Anthropicは、生成型AIモデルと生成型AIシステムの両方のプロバイダーとして、EU AI法の第50条(2)「AI生成コンテンツの透明性に関する行動規範」に署名しました。この記事では、これらのコミットメントをどのように実践しているか、マーキングの仕組み、およびその制限事項について説明します。詳細な技術ガイダンスが利用可能になったら、この記事を更新し、より詳しい技術ガイダンスを公開します。

EU AI法のAI生成コンテンツ透明性行動規範に基づくAnthropicのコミットメント

Claudeのマーキングコミットメントが意味すること:

  • 新しいモデルは初日からAI生成コンテンツをマークします。 2026年8月2日以降にEUで発表されたClaudeモデルは、起動時に機械可読マーキングをサポートします。生成されたテキストには埋め込みウォーターマークが付き、生成されたファイルはサポートされている場合、Content Credentials (C2PA)を含みます。

  • マーキングはClaudeを使用するあらゆる場所で機能します。 マークは、Claude Platform (API)、Claude、Claude Code、Claude Cowork、Claude Tagを含むサポートされているClaudeモデルからの出力に適用され、世界中のClaudeが提供されるあらゆる場所に適用されます。一部のプラットフォームまたは機能は、特定のマーキングタイプをサポートしていない場合があります。

  • 既存のモデルは進行中です。 法律には2026年8月2日より前に発表されたAIシステムの移行期間が含まれており、以前のClaudeモデルのマーキングサポートを追加するために取り組んでいます。下記のウォーターマークをサポートするClaudeモデルを参照してください。

  • ウォーターマーク検出はプライベートプレビュー中です。 ウォーターマーク検出は現在、EU法で要求されている適格な組織(規制当局、法執行機関、メディア、ファクトチェッカー、独立した研究者、教育機関、EU市民社会団体など)が利用できます。また、法律への準拠を確認するためにウォーターマーキングを検証する義務がある企業も利用できます。検出APIへのアクセスを時間をかけて拡大する予定です。アクセスへの関心を登録できます:Claude Watermark Detector Access Request Form。

マーキング計画の詳細は以下の通りです。


Claude生成コンテンツの機械可読マーク

AI生成コンテンツが一般的になるにつれて、コンテンツの出所に関する透明性と信号が増すことで、人々が消費する情報について有用なコンテキストを提供できます。透明性をサポートし、法的義務に準拠するために、Anthropicはクロードが生成するコンテンツに機械可読マークを含めるために取り組んでいます。

対象範囲

  • モデル。 2026年8月2日以降に発表されたClaudeモデルは起動時にマーキングをサポートし、その日付より前にリリースされた他のClaudeモデルにマーキングサポートを追加するために取り組んでいます。現在のリストについては、下記のウォーターマークをサポートするClaudeモデルを参照してください。

  • 製品。 Claudeマーキングは、Claude Platform (API)、Claude、Claude Code、Claude Cowork、Claude Tagを含む、Claudeを使用するあらゆる場所でサポートされているモデルからの出力をカバーします。埋め込みウォーターマークはすべての生成されたテキストに適用されます。Content Credentials (C2PA)は、Claudeがファイル処理をサポートする場所に適用されます。

  • クラウドパートナー。 サポートされているClaudeモデルがAWS、Google Cloud、またはMicrosoft Foundryを通じてアクセスされる場合、ウォーターマークが付きます。Content Credentials (C2PA)はClaudeがファイルを作成するときに追加されるため、プラットフォームがClaudeのファイル生成機能を提供する場所にのみ適用されます:Claudeアプリとの Claude Platform (API)(AWS上のClaude PlatformおよびMicrosoft FoundryのClaudeを含む)。

  • 地域。 マーキングは、世界中のClaudeが提供されるあらゆる場所でサポートされているモデルからの出力に適用されます。

ウォーターマークをサポートするClaudeモデル

モデル

Claude出力のテキストウォーターマーク(ファーストパーティサーフェス)

クラウドパートナー出力のテキストウォーターマーク(AWS、Google Cloud、Microsoft Foundry)

ファイル内のContent Credentials (C2PA)

Claude Fable 5.1

✅

✅

✅

Claude Fable 5

✅

✅*

✅

Claude Mythos 5.1

✅

✅

✅

Claude Mythos 5

✅

Claude Opus 5.5

✅

✅

✅

Claude Opus 5

✅

✅

✅

Claude Opus 4.8

✅

✅*

✅

Claude Opus 4.7

✅

Claude Opus 4.6

✅

Claude Opus 4.5

✅

Claude Sonnet 5.5

✅

✅

✅

Claude Sonnet 5

✅

✅*

✅

Claude Sonnet 4.6

✅

Claude Sonnet 4.5

✅

Claude Haiku 5.5

✅

✅

✅

Claude Haiku 4.5

✅

*Amazon Bedrockでのロールアウトは10月17日までに完了します。

行動規範に基づくコミットメントと一致して、Anthropicは2026年8月2日より前にリリースされたモデルからの出力にウォーターマークを追加しています。

Claudeがコンテンツをマークする方法

Claudeは、Claudeによって生成および処理されたコンテンツをマークするために、2つの相補的な技術を使用します:(1)テキストに埋め込まれたウォーターマーク、および(2)ファイルに添付されたContent Credentials (C2PA)。

1. テキストに埋め込まれたウォーターマーク

サポートされているClaudeモデルがテキストを生成すると、テキスト自体に知覚できないウォーターマークを織り込みます。見えることはなく、Claudeの応答の意味、品質、または読みやすさは変わりません。

ウォーターマークはテキストの一部であるため、テキストがコピーして他の場所に貼り付けられるときにテキストと一緒に移動し、編集を通じて持続する可能性があります。ウォーターマーキングはモデルレベルで適用されます。つまり、テキストがどのClaudeプロダクトまたはサーフェスから来ているかに関係なく、存在します。

2. Content Credentials (C2PA)

Claudeが、PNGやJPEGなどのサポートされているファイルタイプを生成すると、署名された出所メタデータが添付されます。このメタデータはContent Credentialと呼ばれ、Coalition for Content Provenance and Authenticity (C2PA)オープンスタンダードに従います。これは業界全体で使用され、コンテンツの出所に関する情報を記録します。署名されたメタデータラベルが存在する場合、ファイルがClaudeによって処理されたことを示します。

Claudeのマークを検出する

検出は、テキストまたはファイルがサポートされているClaudeマークを持っているかどうかを確認します。サポートされているマークが見つかった場合、コンテンツがClaudeによって生成または処理された可能性があることを示します。

ファイルにClaudeが発行したContent Credentialが含まれているかどうかを確認するには、無料のClaude Content Checkerを使用してください。Claudeがファイルをマークする方法とClaudeが発行したContent Credentialsを検証する方法の詳細については、生成されたファイルのContent Credentialsを参照してください。

ウォーターマーク検出は現在プライベートプレビュー中で、EU法で要求されている適格な組織(規制当局、法執行機関、メディア、ファクトチェッカー、独立した研究者、教育機関、EU市民社会団体など)が利用できます。また、法律への準拠を確認するためにウォーターマーキングを検証する義務がある企業も利用できます。検出APIへのアクセスを時間をかけて拡大する予定です。アクセスへの関心を登録できます:Claude Watermark Detector Access Request Form。

制限事項

機械可読マークはコンテンツに関する重要な信号を提供しますが、すべてのコンテンツタイプ全体での制限事項を理解する価値があります。

  • 検出されたマークはコンテンツがClaudeによって処理されたことを示す信号ですが、完全に決定的ではありません。 Claudeマークを検出することは、コンテンツがClaudeによって処理された可能性があることを示します。それだけでは、コンテンツの完全な出所を確認しません。例えば:

    • Claudeが元の著者ではない可能性があります。人々はしばしばClaudeを使用して、校正、翻訳、要約、またはファイルを変換します。基礎となるアイデア、テキスト、またはデータが別のソースから発信された場合でも、出力はClaudeマークを持つことができます。

    • Claudeが処理した後、コンテンツが変更された可能性があります。マークされたコンテンツは、Claudeが処理した後、他の素材と変更、抜粋、または組み合わされる可能性があります。

  • 検出されたマークがないことは、コンテンツがAI生成または処理されていないことを意味しません。 Claudeによって生成されたコンテンツは、例えば、検出可能なマークを持たない場合があります:

    • そのモデルのマーキングがサポートされる前にモデルによって生成されました。

    • テキストが大幅に編集、言い換え、翻訳、または他の執筆に混ぜられました。

    • パッセージが非常に短く、信頼できる信号のためのテキストが不足しています。

    • ファイルのメタデータは、フォーマット変換、再保存、スクリーンショット、またはその他の手段を通じて削除されました。

    • 特定のマーキングタイプがサポートされていなかったプラットフォーム、機能、またはファイルタイプを通じて生成されました。

Claudeで構築する場合

独自の製品にClaudeをデプロイする場合、第50条がお客様の製品およびサービスに何を要求するかを独立して評価する必要があります。EU行動規範に基づくコミットメントと一致して、お客様が独自の透明性義務を満たすのをサポートすることが目標であり、マーキングと検出アプローチに関する技術ガイダンスが利用可能になったら共有します。

こちらの回答で解決しましたか?