2026年8月14日、AnthropicはClaudeに組み込まれた新しいテキスト透かし(ウォーターマーク)システムの詳細を発表しました。このシステムは2026年8月2日以降にリリースされたすべてのClaudeモデルですでに有効化されており、今後数か月かけて旧モデルにも順次展開されます。EU AI法第50条に基づく透明性要件を満たすよう設計されており、世界中で有効化されています。
発表の中で最も重要なポイントは、この透かしが「何ではないか」です。Anthropicはゼロ幅スペース、隠しUnicodeタグ、あるいは不可視のメタデータを出力文字列に埋め込んでいるわけではありません(画像やファイルの出力は標準のC2PAメタデータを利用しており、別パイプラインです)。その代わりに、Claudeのテキスト透かしは完全に統計的なものです。
この仕組みの本質は次の点にあります。Anthropicのテキスト透かしはテキストに何も追加せず、Claudeが次の単語をサンプリングする方法を変更します。これを除去する唯一の確実な方法は、独立したシステムでまったく同じ意味を保ったまま下書きを再構成し、すべての単語を選び直すことです。この意味論的な再構成こそが、Pro Text Watermark Removerの中核設計です。
Claudeの最新出力に対して従来のクリーニングツールが機能しない理由を理解するには、フォーマットの残留物と統計的サンプリングを区別する必要があります。
「透かし」と呼ばれる全く異なる2つの仕組み
「AIの透かし」について語られる際、関連性のない2つの技術的現象が混同されがちです。
| カテゴリ | 仕組み | 検出可能性 | 除去方法 |
|---|---|---|---|
| フォーマットおよびUnicodeの残留物 | LLMのWebインターフェースから貼り付けられた物理的な文字(例:ChatGPTのU+202F(ノーブレークスペース・狭)、ゼロ幅文字、異常な空白)。 | 文字コードのスキャンにより、ローカルで完全に検出可能。 | ブラウザローカルでの正規表現およびUnicodeサニタイズ。 |
| 統計的サンプリングによる透かし | トークン生成時に適用される数学的バイアス(Claudeの2026年のシステム、Google DeepMindの『Nature』掲載研究)。 | ローカルでは不可視。モデルプロバイダーの秘密検証キーが必要。 | すべての単語を再サンプリングする、意味を保持した再構成。 |
第1のカテゴリは、フォーマット上のアーティファクト(残留物)です。特定のWebインターフェースからテキストをコピーすると、隠しUnicode文字、不揃いな改行、またはU+202Fのような特定のスペースが含まれることがよくあります。これらはクリップボードバッファに存在する物理的な文字です。スキャンして強調表示し、単純な文字列置換で取り除くことができます。
第2のカテゴリが、Claudeの新しいシステムです。除去すべき不正な文字は存在しません。テキストは完全に通常の読解可能な単語のみで構成されています。透かしは純粋にそれらの単語間の統計的関係の中に存在します。
Claudeの統計的透かしの仕組み
Anthropicは特定のスコアリングキーを非公開にしていますが、その基盤となるアーキテクチャは擬似乱数トークンバイアスに関する基礎研究(Natureの2024年の透かし研究で概説されたフレームワークなど)に基づいています。
Claudeが応答を生成する際、次のトークンの確率分布を計算します。単語を選択する前に、アルゴリズムは先行するトークンとAnthropicの秘密の暗号化キーを使用して、語彙を決定論的に擬似乱数グループ(多くの場合「グリーンリスト」および「レッドリスト」と呼ばれます)に分割します。その後、「グリーン」グループを優先するように選択確率をわずかに引き上げます。
人間の読者にとって、文章は自然に読めます。しかし数百単語にわたると、不釣り合いに多くのトークンがグリーンリストに収まります。
Anthropicはまだ一般公開の検証APIをローンチしていませんが、公開された場合、検出にはその統計的偏りを評価するためのAnthropicのプライベートキーが必要になります。ここには重要な運用上の境界があります。
- 検出サービスは、Claudeが文章生成に関与したかどうかを推定することしかできません。
- 人間が執筆したことを証明することはできません。
- 他のAIプロバイダーによって生成されたテキストを検出することはできません。
- 暗号化されたトークンシーケンスを検証するのではなく一般的な文体パターンを推測する、PangramやGPTZeroのような分類器ベースの「AI文体」検出器とは完全に異なります。
文字削除や軽微な編集が通用しない理由
Claudeの透かしはテキスト内に物理的な痕跡を残さないため、従来のクリーニングワークフローは機能しません。
- Unicodeクリーナーは削除対象を見つけられません。 存在しない隠し文字を削除することはできません。
- 単純な類語への置き換えでは分布が維持されます。 3つの形容詞を入れ替えたり導入節を削除したりしても、周囲のトークンシーケンスはそのまま残ります。Anthropic自身のドキュメントでも、軽微な編集では検出可能なレベルの統計的シグナルが残ることが多いと指摘されています。
- 句読点や大文字・小文字の調整では何も変わりません。 カンマをセミコロンに変更したり大文字・小文字を変換したりしても、統計的バイアスを形成する基盤となる単語の選択は変わりません。
Claudeが下書きをゼロから作成した場合や他言語に翻訳した場合、Claudeがすべての単語を選択しています。それらの特定の単語選択が再構成によって解体されるまで、トークンシーケンスには透かしが残ります。
AIによるテキストの再構成
Anthropicのヘルプドキュメントでは、透かしの耐久性の裏返しとして、すべての単語を変更する完全な書き換えを行えば統計的な痕跡が消去されることが明記されています。
ここで機能するのがText Watermark Removerです。
[Claude Watermarked Draft]
│
▼
[Semantic Extraction] ── (Isolates logic, facts, arguments, structure)
│
▼
[Independent Re-sampling] ── (Generates brand-new token sequence via distinct model)
│
▼
[Clean Reconstructed Output]Proエンジンは、表面的な文字列置換を行う代わりに、根底にある意味的ペイロード(中核となる主張、事実、論理展開、技術的詳細)を抽出し、独立したAIパイプラインを使用して下書き全体をゼロから再構築します。まったく別のモデルが無加重の分布下ですべてのトークンを選択するため、元のサンプリングバイアスは破棄されます。
提供ツールの構成
- 無料スキャン(ブラウザローカル): 約60種類の不可視Unicodeコードポイント(
U+202Fを含む)をスキャンしてクリーンアップし、Web貼り付け時の残留物やMarkdownの異常を取り除きます。すべてブラウザ内で完結して動作します。 - AI Text Watermark Detector: Unicodeおよびフォーマットのアーティファクト検出に特化しています。統計的分類器ではなく、Anthropicのサンプリング透かしを検出することはできません。
- Pro Text Watermark Remover: 統計的透かしに対する主要ソリューションです。すべてのトークンが新たに選ばれるよう、意味を保持した完全な再構成を実行します。
- AI Humanizer: トーン、リズム、会話の抑揚を調整するために設計された付属ツールです。文体の特徴を変更しますが、トークンレベルのサンプリング透かしに対する直接的な解決策は依然として完全な意味論的再構成です。
明確で誠実な制限事項
誇大広告ではなく技術的な透明性を重視しています。
- 無料スキャンではClaudeの公式な統計的透かしを除去できません。
- 意味を保持した再構成は研究者が説明する完全書き換えの基準を満たしますが、軽微な言い換えではエッジケースにおいてわずかな統計的断片が残る可能性があります。
- Anthropicのプライベートキーを保有しておらず、公式の「検証通過」証明書を発行することはありません。
- サードパーティのAI検出器(Turnitin、GPTZero、Pangramなど)の完全な除去やバイパスを保証するものではありません。
- 再構成されたテキストは完全に新しく生成されたものであり、人間が入力したことの法的または実証的な証明にはなりません。
再構成が不要なケース
Claudeによって生成されたすべてのテキストを再構成する必要があるわけではありません。多くの実用的なシナリオにおいて、透かしは存在しないか、完全に無関係です。
- 短いスニペット(100〜200単語未満): 統計的透かしは、統計的信頼度を算出するのに十分なサンプルサイズを必要とします。極端に短い出力には、確実な検出に必要な数学的密度がありません。
- 事実密度の高いリスト、表、コード: Python関数、SQLクエリ、表形式データを生成する場合、モデルの語彙は構文や論理によって大きく制限されます。エントロピーが低いコンテキストでは、透かしは自然と弱くなるか無効になります。
- 人間が作成した下書きの軽微な校正: 自身で下書きを執筆し、Claudeに誤字修正や文法調整を依頼した場合、Claudeはすべての単語を選び直すのではなく既存の表現を修正しています。人間主導の編集には透かしが強く付与されません(ただし、翻訳ではClaudeがターゲット言語の全語彙を生成するため透かしが付与されます)。
- 社内作業用ドラフト: 個人のメモ、ブレインストーミング、社内レビューを目的としたドキュメントの場合、数学的痕跡を消去しようとするのは不要な労力です。
まとめと次のステップ
Anthropicのテキスト透かしは高度な数学的手法ですが、その運用の境界は明確です。それはClaudeが選択する特定の単語シーケンスの中に存在します。意味を保ったままそのシーケンスを解体すれば、透かしは存在しなくなります。
クリップボードの残留物や不可視文字に対処する場合は無料のブラウザツールをご利用ください。Claude生成コンテンツから統計的サンプリングの痕跡を除去する必要がある場合は、Proの再構成ワークフローをご利用ください。
- 専用のClaude Watermark Removerガイドを見る
- 料金プランページでプラン詳細を確認する
- AI Text Watermark Detectorで下書きに隠し文字が含まれていないか検査する
免責事項:AI Text Watermark Removerは独立したサードパーティユーティリティであり、Anthropic、OpenAI、またはGoogleと提携、承認、スポンサー関係にあるものではありません。
公式情報源および技術リファレンス
- Anthropic公式発表(2026-08-14):https://www.anthropic.com/news/claude-text-watermark
- Claudeヘルプセンター — How Claude Marks Content:https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- 言語モデルの透かしに関するNature研究論文:https://www.nature.com/articles/s41586-024-08025-4



