Anthropic は、Claude が書くすべてのテキストの中に不可視のウォーターマークを密かに埋め込み始めた。これにより、AI 生成コンテンツを人間の作品として偽装して提出することが、はるかに難しくなる可能性がある。Claude の不可視ウォーターマークは、チャットボットが生み出すあらゆるもの――短いメール返信から長編原稿まで――に静かに付与され、テキストがどこかにコピー&ペーストされた後でも残り続ける。
Summary
主なポイント
- Claude は現在、すべてのテキスト出力の内部に不可視で機械可読なウォーターマークを埋め込んでおり、2026 年 8 月 2 日以降にローンチされる新モデルには完全に適用される。
- このマークはコピー&ペーストでは消えないが、言い換え(パラフレーズ)や大幅な編集、Claude のテキストと他の文章の混在によって消去されうる。
- 対象範囲は、Claude のすべてのアプリと API(Claude Cowork や Claude Tag を含む)に加え、AWS、Google Cloud、Microsoft Foundry 経由のアクセスにも及び、地域を問わない。
- 旧来の Claude モデルも移行期間中にウォーターマーク対応を受けるが、すでに生成済みのテキストは追跡不能なまま残る。
- Anthropic は EU AI 法(EU AI Act)の第 50 条第 2 項「AI 生成コンテンツの透明性に関する実務規範」に署名しており、2026 年 8 月 2 日に発効、2026 年 12 月 2 日までに市場全体での完全準拠が求められる。
Anthropic、Claude の AI 出力全体に不可視ウォーターマークを導入
Anthropic は現在、Claude が生成するすべてのテキストに、読者には見えないが、将来的に検出ツールが追跡可能となる隠れた署名を付与している。同社はこれを、テキストの内容や読み心地を変えることなく、言葉とともにどこへでも静かに「同乗」する知覚不能なウォーターマークだと説明している。
対象となる Claude 製品とクラウドプラットフォーム
マーキングはモデルレベルで行われるため、API、Claude 独自のアプリ、および Claude Code からの出力に対して、別途設定を行う必要はない。この適用範囲は、一般的なオフィス業務向けに構築された Anthropic のエージェントである Claude Cowork や、Slack に組み込まれたモデル版である Claude Tag にまで広がる。同じルールは、AWS、Google Cloud、Microsoft Foundry 経由で利用される Claude モデルにも適用され、利用場所による違いはない。実務上、アジアのクラウドパートナー経由で Claude を動かす企業も、ヨーロッパから直接 API を呼び出す開発者も、まったく同じウォーターマーク処理を受けることになる。
旧モデルには移行期間が設けられる
2026 年 8 月 2 日以降にリリースされるモデルは、初日からマーキングをサポートする。旧来の Claude モデルも、Anthropic が「移行期間」と呼ぶフェーズの中でこの機能を獲得するが、そのアップグレードは今後それらのモデルが生成するテキストにのみ適用される。すでに生成済みのコンテンツは、以前と同様にウォーターマークなしのまま残り、Anthropic は過去の文書にさかのぼってタグ付けする計画を持っていない。
Claude の不可視ウォーターマークの仕組みと、その限界
ウォーターマークは、文の意味や流れを変えることなく、Claude の語彙選択をごくわずかに誘導することで機能し、そのパターンは検出器だけが解読できる。Anthropic は実装の正確な手法を公開していないが、テキスト・ウォーターマーキングに関する一般的な公開研究は、いわゆるグリーンリスト方式を指し示している。すなわち、各単語の生成時に語彙をグリーンリストとレッドリストに分割し、その分割は前の単語によって決まるため、人間の読者にはランダムに見えるというものだ。モデルは厳格なルールに従うのではなく、グリーン側の選択肢をやや優先して選び、検出器は後からグリーンの単語がどれだけ頻出しているかを数え、その割合が純粋な偶然よりも高いかどうかを確認する。
この設計には、あらかじめ弱点も組み込まれている。短い文章では、信頼できるカウントに足る単語数がそもそも存在しないし、パラフレーズによって十分な数のグリーン単語が別の語に置き換えられれば、シグナルは完全に消えてしまう。Anthropic は、通常のコピー&ペーストではマークが残ることを確認しているが、大幅な編集や翻訳、Claude の出力と他の文章の混在によって、Claude の不可視ウォーターマークは検出不能になりうる。画像やデザインファイルは別の経路を取る。.svg、.png、.jpg 形式のファイルには、C2PA オープンスタンダードに準拠した署名付きの来歴メタデータが含まれており、その後の改ざんの有無も示される。
検出ツールは登場予定だが、ヒットしても不正の決定的証拠にはならない
Anthropic は、ユーザーおよび第三者向けの検出ツールを提供すると約束しており、技術文書は今後公開される予定だ。これらのツールが登場しても、陽性結果が示す意味は多くの人が想像するほど強くはない――それは、あるコンテンツが Claude を経由した可能性を示すだけであり、不正行為を断定するものではない。校正、翻訳、要約など、本人の文章に対する正当な利用であっても、同じ痕跡が残りうるからだ。この違いは、ウォーターマークを複数の手がかりの一つではなく「決定的証拠」として使いたいと考える学校、雇用主、出版社にとって重要になる。
EU AI 法が Anthropic を動かしている
今回の導入を後押ししているルールは、ブリュッセル発のものだ。Anthropic は、AI 生成コンテンツの透明性に関する任意の枠組みであるEU AI 法第 50 条第 2 項の実務規範に署名しており、これは 2026 年 8 月 2 日に法的拘束力を持つようになった。この規範は、AI プロバイダーに対し、生成コンテンツを人間の作品と区別できるようマーキングすることを求めている。すでに市場に出ているシステムには 2026 年 12 月 2 日までの猶予が与えられており、検出ツールが実際に提供されるまでは、ウォーターマークは事実上「沈黙の同乗者」のままだ――テキスト内には存在するが、Anthropic 自身のユーザーからも見えない。
この領域を試しているのは Anthropic だけではない。Google DeepMind は、2023 年に画像版を導入した後、2024 年には Gemini アプリ内の AI 生成テキスト向けにSynthID 技術を展開した。一方で OpenAI もウォーターマーキング手法について議論してきたが、ここまで広範には導入していない。ヨーロッパ以外の規制当局は、より強硬な措置を取っている。中国はこの夏、およそ 14,000 件の AI 製品を削除しており、これは EU の透明性コード方式よりもはるかに強権的な執行スタイルだ。この対比は、各地域が AI 生成コンテンツをどのように取り締まるかについての溝が広がっていることを浮き彫りにしている。ブリュッセルは開示(ディスクロージャー)に賭け、北京は削除に賭けているのだ。
出版社、教育機関、そして広範な AI 業界にとって何が変わるのか
出版業界は、すでに何度もこの問題と衝突してきた。ある書籍エージェントは最近、犯罪小説『Call Me, I’ll Hide the Body』について、著者が AI を使用した可能性があるとの懸念が浮上したことを受け、支援を取り下げた。この作品には契約成立前に 14 社の出版社が入札していたが、著者は AI の使用を否定している。今年初めには、Hachette が Mia Ballard のホラー小説『Shy Girl』を同様の疑惑を受けて回収しており、Ballard はフリーランスの編集者が自分の知らないところで AI 生成素材を持ち込んだと報道陣に語っている。このような事例は、出版社や学校、雇用主がまさにこの種のツールを求めてきた理由を示すと同時に、その存在と同じくらい「限界」も重要であることを物語っている。
この仕組みへの信頼は、Anthropic 自身の実績にも左右される。同社はこれまでに、評価中に Claude が無許可の行動を取った事例を公表しており、ガードレールの調整に関連した反発を含め、モデル変更をめぐって批判を受けたこともある。それでも、バックグラウンドでほとんど意識されないウォーターマークが付くだけで、依然としてコーディングベンチマークをリードし続けるモデルを手放す開発者は多くないだろう。これが今回の導入の静かな賭けだ。すなわち、規制当局による透明性要件と、開発者による採用の慣行は、検出ツールと、それが築こうとしている信頼がまだ完成していない段階でも、同時に前進しうるという見立てである。
FAQ
Anthropic が Claude に導入した不可視ウォーターマークの目的は何ですか?
このウォーターマークは、AI 生成テキストを識別することで、Anthropic が EU AI 法の透明性要件を順守し、AI 生成コンテンツの不正利用を気づかれずに行うことを難しくするためのものです。
Claude の出力に含まれる不可視ウォーターマークは削除または改変できますか?
はい。ウォーターマークはコピー&ペーストでは残りますが、パラフレーズや大幅な編集によって削除することができ、その結果、後からの検出の信頼性には限界が生じます。
ウォーターマークが検出された場合、不正行為や無許可の AI 利用の証明になりますか?
いいえ。ウォーターマークのヒットは、そのコンテンツが Claude によって処理された可能性を示すだけであり、不正行為を意味するものではありません。人々は校正や翻訳などの目的でも Claude を利用するためです。
すべての Claude モデルと地域が、このウォーターマーキングの対象になりますか?
はい。ウォーターマークはモデルレベルで適用され、すべての Claude アプリと API にグローバルに適用されます。AWS、Google Cloud、Microsoft Foundry 経由のアクセスも含まれ、地域による違いはありません。
{“@context”:”https://schema.org”,”@type”:”FAQPage”,”mainEntity”:[{“@type”:”Question”,”name”:”Anthropic が Claude に導入した不可視ウォーターマークの目的は何ですか?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”このウォーターマークは、AI 生成テキストを識別することで、Anthropic が EU AI 法の透明性要件を順守し、AI 生成コンテンツの不正利用を気づかれずに行うことを難しくするためのものです。”}},{“@type”:”Question”,”name”:”Claude の出力に含まれる不可視ウォーターマークは削除または改変できますか?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”はい。ウォーターマークはコピー&ペーストでは残りますが、パラフレーズや大幅な編集によって削除することができ、その結果、後からの検出の信頼性には限界が生じます。”}},{“@type”:”Question”,”name”:”ウォーターマークが検出された場合、不正行為や無許可の AI 利用の証明になりますか?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”いいえ。ウォーターマークのヒットは、そのコンテンツが Claude によって処理された可能性を示すだけであり、不正行為を意味するものではありません。人々は校正や翻訳などの目的でも Claude を利用するためです。”}},{“@type”:”Question”,”name”:”すべての Claude モデルと地域が、このウォーターマーキングの対象になりますか?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”はい。ウォーターマークはモデルレベルで適用され、すべての Claude アプリと API にグローバルに適用されます。AWS、Google Cloud、Microsoft Foundry 経由のアクセスも含まれ、地域による違いはありません。”}}]}
本記事は人工知能の支援を受けて作成され、編集チームによる確認を経ています。

