いろは堂AI ← 戻る

Claudeの電子透かしとは?AI文章の見分け方

2026年8月22日|いろは堂AI編集部
屋内、机で脚本らしき文書をノートパソコンで開き手を添える人物の写真

画像出典: Ron Lach / Pexels

この記事の要点
Anthropicは2026年8月2日以降にリリースされるClaudeモデルから、テキストへの電子透かしと、生成画像へのC2PA準拠の出自メタデータの付与に対応しています。テキスト側はGoogle DeepMindのSynthID-Textを改良した方式で、単語を選ぶときの乱数の種を「秘密鍵+直前の文脈」に置き換え、意味をほぼ変えない範囲の単語選択に統計的な偏りを埋め込みます。ただし検出できるのは「Claudeが処理した可能性がある」ことまでで、短文・数式・全面的な書き直しでは機能しません。
🤔
この文章、AIが書いたやつじゃないの?って思うことがあるけど、実際に見分ける方法ってあるのかな。

AIが書いた文章かどうかを判定するツールは以前からありますが、その多くは「文体がAIっぽいか」を推測しているだけで、外れることも珍しくありません。ところが2026年8月から、AIを作っている側が出力そのものに印を埋め込む動きが始まりました。

Anthropicは2026年8月2日以降にリリースされるClaudeモデルから、テキストへの電子透かしと、生成画像へのC2PA準拠の出自メタデータ付与に対応しています。既存モデルへの適用作業も進行中と説明されています。対象はClaude Platform(API)、消費者向けのClaudeアプリ、Claude Code、Claude Cowork、Claude Tagなど、Claudeが出力を生成するあらゆる場所です。

正直なところ、これは「これでAI文章が全部見抜ける」という話ではありません。しくみを知ると、どこまで分かってどこから分からないのかがはっきりします。

そもそも、なぜ今このしくみが入ったのか?

直接のきっかけは制度です。2026年8月2日に発効したEU AI法第50条は、AIが作ったコンテンツであることを開示する透明性義務を定めています。Anthropicの対応はこの義務への回答として始まりました。

ただし適用範囲はEU域内に限定されず、日本を含む世界全体の地域・プロダクトに及びます。つまり日本から日本語でClaudeを使っている場合も、同じように印が付く前提で考える必要があります。

😲
文章に印を埋めるって、見えない文字でも混ぜてるの?

文字を足さずに、どうやって文章へ印を埋めるのか?

隠し文字は使われていません。テキストの透かしはGoogle DeepMindの「SynthID-Text」(AIが生成した文章に統計的な印を埋め込む技術)をベースに改良した方式で、埋め込みの舞台になるのは単語の選び方そのものです。

言語モデルは次の単語を1語ずつ選んでいきますが、そのとき候補は1つに決まりません。「The weather today was cold and」に続く語なら、「overcast」でも「grey」でも読み手にとって意味はほぼ変わりません。どちらを選んでも文章として成立する、この余地が鍵になります。

Anthropicの方式は、この単語選択に使う乱数生成の種を「秘密鍵+直前の文脈」に置き換えます。すると選ばれる語に、鍵を持つ側だけが照合できる統計的な偏りのパターンが残ります。意味の変わらない低リスクな選択を何度も繰り返すことで、文章全体としては検出可能なパターンになる、という設計です。

文字を追加しているわけではないため、速度や価格への実質的な影響はありません。読んでいる側から見ると、文章は普通の文章のままです。

テキスト透かしの要点
  • ベースはGoogle DeepMindのSynthID-Textを改良した方式
  • 乱数の種を「秘密鍵+直前の文脈」に置き換える
  • 埋め込まれるのは統計的な単語選択の偏り
  • 文字の追加や隠し文字はなく、速度・価格への実質的な影響もない

画像にはどんな情報が付くのか?

画像はテキストと事情が違うため、別のしくみが使われます。.png、.jpg、.svgの各ファイルには、C2PA(Coalition for Content Provenance and Authenticity/コンテンツの来歴を記録・署名する業界規格)に準拠した署名付きの来歴メタデータが付与されます。

ここで記録されるのは2つです。ひとつは、そのファイルがClaudeで処理された可能性を示すこと。もうひとつは、生成された後に改ざんされていないかを検出できることです。署名が付いているため、後から中身が書き換えられれば照合で分かります。

検出されたら「AIが書いた証明」になるのか?

ここが一番誤解されやすいところです。検出されたマークが示すのは「Claudeによって処理された可能性がある」ことまでで、著作の証明ではありません。

たとえば人間が自分で書いた文章に、Claudeで軽く手を入れただけの場合。このときも、全文をAIに書かせた場合と同じマークが付きます。「Claudeが書いた」のか「Claudeが大幅に編集した」のかを区別する手段はありません

提出物のチェックや不正の告発に、この検出結果を単独の根拠として使うのは無理がある、ということです。

透かしが機能しない場面もあります

数式やコードのように、正解が一つしかない事実記述では透かしが働きません。「2+2=」の次に来る語には選択の自由度がなく、偏りを埋め込む余地そのものが存在しないためです。

また短い文章では単語選択の回数が少なく、統計的な偏りとして読み取れるだけの材料が集まらないため、検出精度が落ちます。

編集したら透かしは消えるのか?

程度によります。軽い編集では透かしは完全には消えません。数語を直した程度なら、残った大部分の単語選択にパターンが残っているためです。

一方で、全単語を置き換えるような全面的な書き直しをすると透かしは消えます。埋め込みの担い手が単語選択そのものなので、その選択が総取り替えされれば根拠がなくなる、という理屈です。

画像側にも別の弱点があります。C2PAメタデータはあくまで画像ファイルのメタデータであるため、意図的に取り除く(ストリップする)ことが技術的に容易だという指摘があります。埋め込み先が本文ではなく付随情報である以上、これは方式上の性質です。

  1. まず範囲を確認する対象がテキストか画像かで、埋め込まれているものが単語選択の偏りなのかファイルのメタデータなのかが変わります。
  2. 検出結果の意味を限定する出るのは「Claudeが処理した可能性」まで。書いた割合や執筆者の特定には踏み込めません。
  3. 効かない条件を先に潰す短文・数式やコード・全面書き直し後・メタデータ除去後は、そもそも判定材料がありません。
  4. 単独の証拠にしない制作過程の記録や本人への確認など、別の材料と組み合わせて判断します。
😌
完璧に見抜けるわけじゃないけど、何が分かって何が分からないかは整理できたかも。

この動きを、どう受け止めておけばいいのか?

電子透かしと出自メタデータは、AIコンテンツを一発で判定する装置ではなく、出どころの手がかりを残す土台として設計されています。手がかりが増えること自体は、受け取る側にとって前向きな変化です。

作る側の立場では、Claudeを使って書いた文章や画像には印が付く前提で扱うのが安全です。隠すための小細工を考えるより、どこまでAIに任せたかを自分で説明できる状態にしておくほうが、結果的に扱いやすくなります。

見分ける側の立場では、検出ツールの結果を「証拠」ではなく「一つの手がかり」として扱うこと。しくみを知ってから判断すれば、過信も無視もせずに済みます。

よくある質問

Anthropicの電子透かしはいつから付くようになりましたか?

Anthropicは2026年8月2日以降にリリースされるClaudeモデルから、テキストへの電子透かしと生成画像へのC2PA準拠の出自メタデータ付与に対応しています。既存モデルへの適用作業も進行中と説明されています。

電子透かしを入れると文章の品質や生成速度は落ちますか?

文字の追加や隠し文字はなく、意味がほぼ変わらない範囲での単語選択に統計的な偏りを埋め込む方式のため、速度や価格への実質的な影響はないとされています。

AIが書いた文章を人間が編集すれば透かしは消えますか?

軽い編集では透かしは完全には消えません。ただし全単語を置き換えるような全面的な書き直しをすると透かしは消えます。

透かしが検出されたら、その文章はAIが書いたと断定できますか?

断定はできません。検出が示すのは「Claudeによって処理された可能性がある」ことまでで、人間が書いた文章にClaudeが軽く手を入れただけでも全文生成と同じマークが付き、両者を区別できません。

※記事で使用した内容・数値は変更される場合があります。最新情報は公式サイトをご確認ください。