クロードはAI生成コンテンツをどう識別する?

AnthropicはEU AI法第50条第2項の行動規範に署名し、2026年8月2日以降にリリースされるClaudeモデルはモデルレベルで出力にマークを付けます。以下に、API、Claude Code、Cowork、Tag全体における適用範囲の全容、重要な制限事項、およびご自身のパイプラインに追加すべきチェック事項を記載します。

Ashley Innocent

Ashley Innocent

11 8月 2026

クロードはAI生成コンテンツをどう識別する?

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Anthropicは、EU AI法第50条(2)のAI生成コンテンツの透明性に関する行動規範に署名し、そのコミットメントをモデル自体に組み込み始めています。2026年8月2日以降にリリースされたClaudeモデルは、生成するコンテンツに機械可読なマークを埋め込みます。テキストには知覚できない透かしが言葉の中に織り込まれ、生成されたファイルには暗号的に署名された来歴メタデータが付与されます。

ほとんどの人が見落としている点:これはEU限定の機能ではなく、チャットアプリに限定されるものでもありません。これは、Claude Platform (API)、Claude、Claude Code、Claude Cowork、Claude Tagを介したサポート対象モデルからの出力に、世界中で適用されます。バックエンドからClaude APIを呼び出す場合、返されるテキストにはマークが含まれ、ユーザーに転送するすべてのコンテンツにもマークが含まれます。

これは、モデルをラップするAPIを提供するすべての人にとって、実際的な影響を及ぼします。以下に、そのマークが実際に何であるか、どこに適用されるか、何が証明でき、何が証明できないか、そしてパイプラインに追加すべき具体的なチェックについて説明します。現在AIを利用したエンドポイントをテストしている場合、Apidogは、それらのチェックを誰かの頭の中に置いておくのではなく、すべてのビルドで実行されるように配置するのに適した場所です。

要約

質問 回答
何がマークされますか? 生成されたテキスト(埋め込み透かし)および、.svg.png.jpgなどの生成されたファイル(署名付きC2PAメタデータ)
どのモデルですか? 2026年8月2日以降にリリースされたClaudeモデルが対象。以前のモデルは移行期間中に改修中です。
どのサービスでですか? Claude Platform (API)、Claude、Claude Code、Claude Cowork、Claude Tag
どの地域ですか? EUだけでなく、Claudeが提供されているすべての地域
クラウド再販業者ではどうですか? AWS、Google Cloud、Microsoft Foundryを介しても埋め込み透かしは適用されます。署名付きプロベナンスメタデータは、すべてのプラットフォームでサポートされない場合があります。
オフにできますか? いいえ。テキストの透かしはモデルレベルで適用されます。
マークはClaudeが書いたことを証明しますか? いいえ。それはコンテンツがClaudeによって処理された可能性があることを示します。
マークがないことは人間が書いたことを証明しますか? いいえ。マークがないことは何も証明しません。

Anthropicが実際にコミットした内容

AI生成コンテンツの透明性に関する行動規範は2026年6月10日に公開され、7月末までに約190の署名が集まりました。欧州委員会とAIボードは、AI法第50条への適合を示す適切な自主的ルートとしてこれを承認しました。Anthropicは、生成AIモデルと生成AIシステムの両方のプロバイダーとして署名しました。

Anthropic自身の表現では、4つのコミットメントがあります。

最後の2つは見た目以上に重要です。検出は約束されていますが、まだリリースされていません。そして、モデルの構成は混在しています。2026年初頭のモデルは完全にマークされていないテキストを生成する可能性がある一方で、新しいモデルはすべてをマークします。

テクニック1:テキスト内の見えない透かし

サポート対象のClaudeモデルがテキストを生成する際、透かしをテキスト自体に織り込みます。それは目に見えず、応答の意味、品質、読みやすさを変更しません。目に見えるタグ、追加された文、または16進エディターで確信を持って見つけられるような隠されたUnicode文字はありません。

この設計から2つの特性が導かれます。

伝播します。 透かしはファイルラッパーではなくテキスト内に存在するため、コピー&ペースト後も残ります。Claudeからの段落をメール、CMSフィールド、プルリクエストの説明、またはSlackメッセージに移動させても、シグナルは共に伝わります。それが最大のポイントです。メタデータベースのアプローチはコンテンツがコンテナを離れた瞬間に失効しますが、テキストの透かしはそのような失敗モードを持ちません。

モデルレベルで適用されます。 プロダクトレイヤーではなく、APIの前のフィルターによってもありません。つまり、設定するヘッダーや切り替えるリクエストパラメータはなく、それを削除するエンタープライズティアもありません。APIに基づいて、ホワイトラベル製品のためにそれを削除しようと考えている場合、その選択肢は存在しません。

トレードオフは統計的です。単語の選択に埋め込まれた透かしは、読み取れるだけの十分な単語数を必要とします。3語の応答ではシグナルを隠す場所がないため、非常に短い文章は検出閾値を下回ります。

テクニック2:ファイルに署名されたC2PAプロベナンス

Claudeが現在.svg.png.jpgなどのサポートされているファイルタイプを生成する際、業界全体で使われているContent Credentials形式と同じ、C2PAオープン標準に従って署名されたプロベナンスメタデータを添付します。

C2PAは透かしとは異なる方法で機能します。コンテンツ内にシグナルを隠すのではなく、ファイルがどこから来たか、何がされたかを記述する暗号的に署名されたマニフェストを添付します。マニフェストは署名されているため、改ざんを検出できます。バイトが変更され、マニフェストが再署名されない場合、署名が壊れ、どのC2PAリーダーもその旨を伝えます。

これは本当に有用な特性ですが、本当に厄介な特性も伴います。C2PAメタデータはコンテナレベルの添付ファイルなので、コンテナを書き換えるものは何でもそれを削除できます。再エンコード、サイズ変更、形式変換、スクリーンショット、または自動最適化を行う画像CDNはすべて、喜んでマニフェストを破棄します。あなたのアップロードパイプラインは、それが起こる可能性が最も高い場所の1つです。だからこそ、誰かにプロベナンス保証を約束する前に、APIがC2PAメタデータを削除するかどうかをテストする価値があります。

マニフェスト自体を検査したい場合は、c2patoolがコマンドラインから読み取り、Content Credentials検証ページがブラウザで行います。C2PAでAI画像検出器APIを構築する際の分類器とマニフェストのアプローチも、同じツールで動いています。

マークが適用される場所

カバレッジは通常のローンチ機能よりも広いため、境界を注意深く読む価値があります。

モデル。 マーキングは2026年8月2日以降にリリースされたモデルに搭載されます。それ以前のものは改修中です。実際には、アプリが今年の初めからのモデルIDを使用している場合、Anthropicが別途通知するまで、その出力はマークされていないと仮定すべきです。

製品。 埋め込み透かしは、Claude Platform (API)、Claude、Claude Code、Claude Cowork、Claude Tagのすべての生成テキストに適用されます。プロベナンスメタデータは、Claudeがファイルの処理をサポートしている場合に適用されます。

クラウドパートナー。 サポート対象モデルがAWS、Google Cloud、またはMicrosoft Foundry経由でアクセスされる場合、埋め込み透かしは透過的に適用されます。署名付きプロベナンスメタデータは、各プラットフォームのファイル処理サポートに依存するため、適用されない場合があります。コンプライアンスの要件がC2PAに特に依存しており、BedrockまたはVertexを経由してルーティングしている場合は、仮定せずに検証してください。

地域。 世界中。義務はヨーロッパのものですが、実装はグローバルです。

検出されたマークが実際に伝えること

このセクションは2度読む価値があります。なぜなら、マーケティングの略語(「Claudeは出力に透かしを入れる」)が、技術がサポートしない結論を誘うからです。

検出されたマークは、コンテンツがClaudeによって処理された可能性があることを示します。著者を特定するものではなく、Anthropicもそれを明示しています。2つの失敗モードにより、人々が期待するよりも弱いものになっています。

Claudeが著者ではない可能性がある。 人々はClaudeを校正、翻訳、要約、ファイルの変換に利用します。人間が900語を書き、Claudeに文章を整えるよう依頼すると、結果にはマークが含まれます。アイデア、報告、そしてほとんどの文章は人間によるものです。マークは、これらのケースと完全な生成とを区別することはできません。

コンテンツが後で変更される。 マークされた出力は編集され、抜粋され、他の素材と混ざり合います。ドキュメント内で見つかったマークは、その一部が特定の時点で触れられたことを示すものであり、ドキュメントが現状のままモデルから生成されたことを示すものではありません。

マークがないことが伝えること:何もなし

逆の誤りはさらに悪いものです。なぜなら、それが人々に対して利用されるからです。Claudeによって真に生成されたコンテンツでも、以下の場合は検出可能なマークを持たないことがあります。

「透かしが見つからない」ことを人間が作成した証拠として扱うワークフローは、設計上破綻しています。これには、学術的誠実性ツール、採用選考、コンテンツモデレーションパイプラインが含まれます。同様の非対称性は、すでに画像分類器に依存している人々を苦しめており、それはAI画像検出が失敗する理由で議論されています。

Claude上に構築する場合の意味

Anthropicの開発者へのガイダンスは短く的確です。自社製品にClaudeをデプロイする場合、第50条が自社製品とサービスに何を要求するかを独立して評価してください。準拠プロバイダーの顧客であるというだけでは、自社が準拠していることにはなりません。

その区別は重要です。Anthropicはプロバイダーであり、第50条(2)に基づく機械可読マーキングの義務を負います。通常、あなたはデプロイヤーであり、第50条(4)はディープフェイクや公共の利益に関するAI生成テキストの公開に関して、あなたに別の義務を課します。これらは異なる義務であり、異なる救済措置があり、API開発者向け第50条の内訳で、どちらがあなたに該当するかを説明しています。

エンジニアリングチームのための3つの実践的な項目:

これを実際に実行するテストに変える

コンプライアンスに関する議論は、文書の中で停滞しがちです。機能し続ける部分は、CIに組み込まれたものです。

AIを利用したAPIの実行可能な一連のコントラクトテスト:

  1. モデルの固定。 応答が期待するモデルIDを報告していることを確認します。サイレントアップグレードやフォールバックは、出力がマークされるかどうかに影響します。
  2. 開示フィールドの存在。 スキーマがai_generated: trueまたはX-AI-Generatedヘッダーを約束している場合、エラーパスやキャッシュパスを含む、モデル出力を返すすべてのパスでそれを確認します。
  3. プロベナンスの存続。 画像を返す、または再提供するすべてのエンドポイントについて、パイプラインがバイトに触れた後もC2PAマニフェストがまだ存在し、検証されることを確認します。
  4. スキーマの適合性。 リファクタリングで開示フィールドが静かに消えることがないよう、応答をOpenAPI定義に対して検証します。

これら4つはすべて通常の表明です。Apidogでは、これらを応答アサーションと応答後スクリプトとして表現し、テストシナリオとして保存し、パイプラインでapidog-cliからシナリオを実行することで、監査で表面化するのではなく、回帰がビルドを失敗させるようにできます。メカニズムは、APIアサーションGitHub ActionsでのAPIテストの自動化で説明されているものと同じです。シナリオを読みながら構築したい場合は、Apidogをダウンロードしてください。

よくある質問

自社製品向けにClaudeの透かしを無効にできますか? いいえ。テキストの透かしはモデルレベルで適用されるため、テキストがどのClaude製品またはサービスから提供されても存在します。それを削除するAPIパラメータ、ヘッダー、プランティアはありません。

透かしはClaudeの出力の品質を変更しますか? Anthropicは、応答の意味、品質、読みやすさを変更しないと述べています。あなたもユーザーもそれに気づくことはありません。

Claudeの透かしをチェックするための公開ツールはありますか? まだありません。Anthropicは、ユーザーとサードパーティ向けの検出サポートを約束しており、技術文書が公開される予定です。それがリリースされるまでは、サードパーティ製の「Claude検出器」を、公式マークのリーダーではなく、未検証の分類器として扱ってください。詳細はClaudeの透かしを検出する方法にあります。

古いClaudeモデルも出力に透かしを入れますか? 自動的には入れません。AI法には、2026年8月2日より前にリリースされたモデルに移行期間が含まれており、Anthropicはそれらにマーキングを追加する作業を進めています。それがリリースされるまでは、古いモデルIDはマークされていないテキストを生成すると仮定してください。

BedrockまたはVertexを介してClaudeを呼び出す場合も適用されますか? 埋め込みテキスト透かしは適用されます。署名付きプロベナンスメタデータは、各プラットフォームが提供するファイル処理機能に依存するため、適用されない場合があります。

これはOpenAIやGoogleが行うこととどう異なりますか? GoogleのSynthIDは画像、音声、ビデオ、テキストをカバーしており、テキスト版はオープンソース化されています。OpenAIは生成された画像にC2PA Content Credentialsを添付しており、2026年5月にはそれらと並行してSynthIDを埋め込むことを約束しましたが、テキスト透かしはまだリリースしていません。比較はClaude vs ChatGPT vs Geminiの透かしで説明されています。

結論

Claudeのマーキングは、異なる2つの役割を果たす2つのものです。テキストの透かしは耐久性があり、言葉とともに伝播しますが、十分なテキストを読み取る必要があり、あくまで「もしかしたらClaudeが触ったかもしれない」としか言えない確率的なシグナルです。C2PAメタデータは正確で改ざん検知可能ですが、あなたの画像パイプラインが誰も気づかないうちにそれを破壊してしまうほど脆弱です。

どちらも盗作検出器ではなく、それ自体でコンプライアンスを保証するものでもありません。これらが提供するのは、正直に扱い、制御しているチェーンの部分をテストすることを条件に、構築できるシグナルです。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる