Anthropic社は、Claudeが生成するすべてのテキストに透かしを埋め込んでいる。読者には見えず、テキストが他にコピーされても透かしは保持される。
新モデルは世界中で透かしを付与されている。Anthropic社は今後、ユーザーや外部向けの検出ツールも提供予定としている。
Claudeの透かし技術の仕組み
Anthropic社はモデルレベルで透かしを付与している。これにより、API、Claudeの各種アプリ、Claude Codeの出力にも透かしが付く。
この仕組みは、オフィス業務向けファイル・タスクエージェント「Claude Cowork」にも適用。Slack内でモデルを利用する「Claude Tag」も同様に対象となる。
AWS、Google Cloud、Microsoft Foundry経由で提供されるClaudeモデルにも同じく透かしが付与される。地域による差もない。Anthropic社は手法を公開していないが、公開されているテキスト透かしに関する研究はグリーンリスト手法の存在を示唆している。
この手法では、単語ごとに語彙をグリーンリストとレッドリストに分割。直前の単語が分割の種となるため、読み手にはパターンがランダムに見える。
モデルはグリーンリストの単語を優先的に選ぶが、厳密なルールで選ぶわけではない。検出器はグリーン単語の比率を計数し、偶然の範囲を超えていれば判定できる。この設計により、Anthropic社が指摘する2つの限界が生じる。短文では単語数が少なすぎて信頼性が低い。一方、言い換えられると、グリーン単語が置き換わってしまう。
ファイルには異なる方式が使われる。生成された.svg、.png、.jpgファイルには、C2PAオープンスタンダードに基づく電子署名付きの出自情報が付与され、不正改ざんも検出できる。
Claudeユーザーが今後注意すべき点
従来モデルについても移行期間中に透かしが付与される。ただし、適用は今後出力されるテキストのみで、既に生成済みの文書には追跡できない。過去に書かれた文章へ遡及的に透かしを付与する計画も存在しない。
この取り組みの中核は検出機能である。Anthropic社はユーザーや第三者向けツールの提供を約束しており、詳細は今後の技術文書で公表予定。検出されたとしても、読者の多くが想定するほど強い意味は持たない。あくまで「Claudeが関与した可能性がある」ことを示す指標にすぎない。
実際は、校正や翻訳、要約など自己執筆文書への活用も多い。したがって、透かし付き文書が不正の証拠とはならない。
このルールの背景にはEU AI規則がある。Anthropic社はAI生成コンテンツの透明性を定めた第50条(2)実践規範に署名し、2026年8月2日に発効した。他国当局はこれより厳しい措置を講じており、中国は今夏、1万4000件のAI関連製品を撤去した。
Anthropic社の実績がユーザーの信頼度を左右する。同社は以前、Claudeが評価中に不正アクセスした3件を公表した。また裁判所は、トレーニング用の書籍スキャンも認定した。
こうしたモデル改修に反発が起きた前例もあり、Fable 5ガードレール問題などが知られる。ただ、依然としてコード系ベンチマークでトップを維持するモデルを離れる開発者は少ないとみられる。導入は静かに進む可能性が高い。
市場投入済みシステムは2026年12月2日までに対応が必要。検出ツールが登場するまで、透かしは“見えない同乗者”のまま残る。









