ai-garage
News 最終更新 2026/8/16

Claudeの透かしは消せる?仕組みをAnthropicが公開|完全な書き直しで消える

Anthropic が2026年8月14日、Claude の文章に入る『見えない透かし』の仕組みを公開したよ。Google DeepMind の SynthID-Text をベースにした方式で、文章の意味は変えず、単語を選ぶときの『くじの引き方』だけを差し替えて印を埋め込むんだ。軽い編集ではたぶん完全には消えず、全部の単語を置き換える完全な書き直しなら消える。Claude に翻訳させた文章にも印は付くよ。適用は EU だけじゃなく全世界で、日本も対象。検出用の API は『近く提供する』と公式が書いた段階で、2026年8月16日時点ではまだ一般に配られていないんだ。

Claudeの透かしは消せる?仕組みをAnthropicが公開|完全な書き直しで消える

この記事の要点

  • Anthropic が2026年8月14日、透かしの仕組みを公式ブログで公開したよ。Google DeepMind が発表した SynthID-Text 方式の一種で、公式は「Claude's text watermark is a version of the SynthID-Text approach published by Google DeepMind」と書いているんだ。
  • 消える条件もハッキリ書かれたよ。公式の表現は「Light editing probably won't remove the watermark completely; a complete rewrite where every word is replaced will」——軽い直しではたぶん消えきらず、全部の単語を置き換える完全な書き直しなら消える、ということだね。
  • Claude に翻訳させた文章にも印は付くよ。翻訳では単語をぜんぶ Claude が選び直すからなんだ(「A translation produced by Claude carries a watermark」)。また文章が長いほど判定の確からしさは上がるとしているよ。
  • 検出用の API は「近く提供する(We will soon be offering a watermark detection API)」段階で、2026年8月16日時点では一般向けの確認ツールはまだ配られていないんだ。透かしの適用は2026年8月2日以降に出た Claude モデルが対象で、EU だけでなく全世界=日本も含むよ。

やっほー、ぼくてんびん丸!

きみがいま Claude に書いてもらった文章、見た目はふつうの日本語だよね。でもこれから、その文字の並びのなかに、目には見えない印がそっと入るようになるんだ。

しかもこれ、EU だけの話じゃない。日本にいるきみの文章も対象だよ。きょうはこのニュースを整理していくね。

【2026年8月16日 追記】 Anthropic が 8月14日に公式ブログで透かしの仕組みそのものを公開したよ。Google DeepMind の SynthID-Text をベースにした方式であること、そして「軽い編集ではたぶん消えない/全部の単語を置き換える完全な書き直しなら消える」という消える条件がハッキリ書かれたんだ。くわしくはこのあとの「透かしはどうやって入っているの?」と「透かしは消せるの?」で整理するね。

何があったの?

Anthropic(Claude を作っている会社)が、Claude の作った文章に人間には知覚できない透かしを埋め込むと、公式のサポートページで明らかにしたんだ。ITmedia によると、発表は2026年8月10日(現地時間)だよ。

まず全体をまとめるとこんな感じ。

項目内容
対象モデル2026年8月2日以降に出た Claude モデル(それより前のモデルにも対応を追加中)
対象サービスClaude アプリ / Claude Platform(API)/ Claude Code / Claude Cowork / Claude Tag
クラウド経由AWS・Google Cloud・Microsoft Foundry 経由のアクセスも対象
適用地域EU だけじゃなく全世界。日本も対象
文章への印人間には知覚できない透かし。意味・品質・読みやすさは変わらない
ファイルへの印.svg / .png / .jpgC2PA 準拠の署名付きの記録を付与
仕組みの公開2026年8月14日に公式ブログで公開。Google DeepMind の SynthID-Text ベース
自分で確認する方法まだ無い。検出用の API を「近く提供する」と公式が明記(2026年8月16日時点)

いちばん大事なのが適用範囲。公式サポートページにはこう書いてある。

Marking will apply to output from supported models wherever Claude is offered, worldwide. (対応モデルの出力には、Claude が提供されている場所すべて、世界中で印が付きます)

つまり「EU のユーザーだけ特別対応」ではなくて、日本で使っていても同じ扱いということだね。

なんで急にそんなことを?

きっかけは EU の AI 法(EU AI Act)だよ。Anthropic は公式サポートページで、EU AI Act 第50条2項の「AI生成コンテンツの透明性に関する行動規範」(Code of Practice on Transparency of AI-Generated Content)に署名したと書いているんだ。

第50条の透明性義務は 2026年8月2日から適用が始まっているルールで、AI が作った画像・音声・動画・文章には「機械が読み取れる印」を付けることが求められているよ。このルール自体の中身(誰が対象で、違反するといくら払うのか、日本の会社は関係あるのか)は、EUの透明性義務が8月2日にスタートした話のほうで詳しく整理してあるから、そっちも見てみてね。

面白いのは、EU で求められたルールを、EU の外にもまとめて広げたという点なんだ。地域ごとに仕組みを分けるより、全部同じにしたほうが運用がラクだから——という判断な気がするけど、結果として日本の利用者にも同じ透明性が回ってくる形になったよ。

ここが一番大事:「AIが書いた証明」にはならない

ニュースの見出しだけ見ると「これでAI文章がバレるようになるのか」と思っちゃうよね。でも公式の説明はもっと慎重なんだ。

Anthropic が書いているのは、この印は「そのコンテンツは Claude が処理したかもしれない(may have been processed by Claude)」ことを示す、ということ。「AI が書いた」の証明ではないんだ。

なぜかというと、こういうことが起きるから。

  • きみが自分で書いた文章を Claude に直してもらった場合も、印は付く(=AI が書いたわけじゃないのに付く)
  • 逆に、印が見つからなくても「AI を使っていない証明」にはならない。モデルの世代・編集・形式の変換によっては検出できなくなる可能性があると公式が明記している

Anthropic は「印の有無が決定的な証拠になるわけではない」という趣旨のことまで自分で書いていて、過剰に期待させない書き方をしているよ。ここ、ちゃんと押さえておきたいところなんだ。

Claudeの透かしが示すことと示さないことを対比した図。示すことは「そのコンテンツをClaudeが処理したかもしれない」、示さないことは「AIが書いたという証明」と「印が無い=AIを使っていない証明」。検出の仕組みは今後の技術文書で公開予定。

透かしはどうやって入っているの?

ここからが8月14日に新しく分かったことだよ。Anthropic が公式ブログで、透かしの中身を説明したんだ。

使っているのは、Google DeepMind が公開した SynthID-Text(シンセッド・テキスト)という方式。公式の言い方はこう。

Claude's text watermark is a version of the SynthID-Text approach published by Google DeepMind. (Claude の文章の透かしは、Google DeepMind が公開した SynthID-Text 方式の一種です)

仕組みのイメージはこんな感じ。AI は文章を作るとき、「次はどの単語を置こうかな」と候補のなかからひとつを選ぶ作業をひたすらくり返しているんだ。このとき候補のなかからくじを引くようにひとつ決めているんだけど、透かしはその「くじの引き方」だけを、決まったルールに差し替える。公式の表現では「the watermark only changes the source of the randomness used to pick among words(単語を選ぶときに使うランダムさの出どころを変えているだけ)」だよ。

だから書いてある内容や意味は変わらない。Anthropic は「Watermarking does not impact the quality of Claude's output(透かしは Claude の出力の品質に影響しない)」と書いていて、Google DeepMind 側の検証でも、印を入れていないモデルとのあいだに統計的に意味のある差は見られなかったとしているよ。

もうひとつ大事なのが文章の長さ。公式はこう書いているんだ。

As a passage increases in length, confidence about Claude's involvement increases too. (文章が長くなるほど、Claude が関わっているという判断の確からしさも上がります)

裏を返すと、一行のメッセージみたいな短い文では判定しにくいということだね。「1文コピペしただけでバレる」タイプの仕組みではないよ。

透かしは消せるの?

ここが今回いちばん検索されそうなところだと思う。答えは「消せるけれど、手直し程度では消えない」だよ。

公式ブログの表現がとても分かりやすいので、そのまま引くね。

Light editing probably won't remove the watermark completely; a complete rewrite where every word is replaced will. (軽い編集では、たぶん透かしは完全には消えません。すべての単語を置き換える完全な書き直しなら消えます)

整理するとこうなるよ。

何をしたか透かしはどうなる?
他の場所にコピー&ペースト残る(文章と一緒に付いていく)
語尾や数語を直す程度の軽い編集たぶん残る(完全には消えないと公式が明記)
全部の単語を置き換える完全な書き直し消える
Claude に翻訳させる残る(翻訳では単語をぜんぶ Claude が選び直すから)

翻訳のところは見落としやすいから、公式の文も置いておくね。

A translation produced by Claude carries a watermark, because in this case every word is chosen by Claude. (Claude が作った翻訳には透かしが入ります。この場合、すべての単語を Claude が選んでいるからです)

つまり「英語で書いてもらって、それを Claude で日本語にする」という流れだと、両方に印が付くということだね。逆に、自分の言葉で全部書き直した文章には残らない。ここは「AI に手伝ってもらったかどうか」ではなく「いま画面にある単語を誰が選んだか」で決まる、と考えると分かりやすい気がするな。

いま自分で確かめる方法はあるの?

まだ無いんだ。 ただし8月14日で一歩進んだよ。Anthropic は仕組みを説明したブログのなかで、こう書いたんだ。

We will soon be offering a watermark detection API. (透かしの検出APIを近く提供します)

時期は書かれていないけれど、「今後の技術文書で共有する」だった8月10日の書き方から、「近く出す」に変わった形だね。それでも2026年8月16日の時点では、一般の人が手元で透かしを確認する道具は配られていないよ。

つまり今の状態は、「印は付き始めたけれど、それを読める人がまだ限られている」という段階だね。学校や会社が「AI 使用チェック」に使えるようになるのは、その道具が配られてからの話になるよ。

画像の透かしとは何が違うの?

「透かし」と聞くと、画像に入れるやつを思い浮かべる人が多いと思う。実はそっちは業界がもう先に手を組んでいる分野なんだ。OpenAI は2026年5月に Google DeepMind の SynthID を採用して、C2PA の署名と二重で画像に埋め込む方針を出しているよ。

今回の Anthropic の発表がちょっと違うのは、文章そのものに埋め込むところ。

対象仕組みいまの状況
文章単語を選ぶときの「くじの引き方」を差し替えて印を仕込む(SynthID-Text 方式)Anthropic が全世界に適用。仕組みは8月14日に公開、検出APIは近く提供予定
画像・ファイル(.svg / .png / .jpg)C2PA 準拠の署名付きの記録OpenAI・Google もすでに採用。ファイル変換で剥がれる弱点あり

画像は「ピクセルに埋める」「ファイルに記録を貼る」と手段が2つあるけど、文章は文字しかない。だから技術的には文章のほうが難しい分野で、そこに大手が本腰を入れてきた、というのが今回の位置づけだと思うよ。

ぼくの感想

正直に言うとね、ぼくは最初「うわ、監視っぽいな」と身構えたんだ。でも公式の説明を読み込んでみたら、印象がけっこう変わった。

Anthropic は「これで AI 文章が判別できます」と売り込んでいないんだよね。むしろ「これは Claude が処理したかもしれないという信号にすぎない」「見つからなくても使っていない証明にはならない」と、自分から限界のほうを先に書いている。透かしの話って、盛って書こうと思えばいくらでも盛れるところだから、ここを最初に置いたのは誠実な気がするな。

気になるのは検出手段がまだ配られていないこと。印だけ先に付き始めて、読み方は後から——という順番だと、そのあいだに「うちの検出ツールなら分かります」と言い出す人が出てきそうな予感がするんだ。公式の検出APIが配られるまでは、そういう主張は話半分で聞いたほうがいいかもしれないね。

8月14日の説明でぼくがいちばん感心したのは、消える条件を自分から書いたところなんだ。「完全な書き直しなら消える」って、見方を変えれば回避方法を教えているわけだよね。それでも書いたのは、たぶん「これは不正を捕まえる罠ではなく、出どころを示す札です」という立場を先にハッキリさせたかったからだと思う。万能だと思わせないほうが、長い目で見て信頼される——そういう判断な気がするな。

あと、これは推測だけど、日本の学校や会社の「AI 使ったかどうか」ルールにも、じわじわ効いてくるんじゃないかな。まだ確かめる道具が無いから今日から何かが変わるわけじゃないけど、「印は付いている」という前提が先にできあがったのは、それなりに大きい変化だと思うよ。

まとめ

きょうのポイントを4つにするね。

  1. Claude の文章に、人間には見えない印が入るようになった。 対象は2026年8月2日以降に出たモデルで、それ以前のモデルにも対応を追加中だよ
  2. 8月14日に仕組みが公開された。 Google DeepMind の SynthID-Text をベースに、単語を選ぶときのくじの引き方を差し替える方式。文章の質は変わらないとされているよ
  3. 消える条件もハッキリした。 軽い編集ではたぶん消えず、全部の単語を置き換える完全な書き直しなら消えるClaude に翻訳させた文章にも印は付くんだ
  4. EU だけの話じゃない。日本も対象。 ただし「AI が書いた証明」にはならないし、検出APIは「近く提供」段階で、いま自分で確かめる手段は無い

「AI で書いたことが全部バレる時代が来た」というよりは、「AI が関わったものに、そっと札を付けておく仕組みが動き始めた」くらいの受け止めが、いまの実態に近いと思う。検出APIが配られたらまた整理するね。

それじゃあまたね、てんびん丸でした!

よくある質問

Q.Claude で書いた文章に透かしは入るの?
A.入るよ。Anthropic は2026年8月2日以降に出た Claude モデルの出力に、人間には見えない透かしを埋め込むと公式サポートページで発表したんだ。それより前に出たモデルにも対応を追加中だよ。対象は Claude アプリ・Claude Platform(API)・Claude Code・Claude Cowork・Claude Tag で、AWS / Google Cloud / Microsoft Foundry 経由で使う場合も含まれるよ。
Q.日本でも透かしは適用されるの?
A.されるよ。もともとの理由は EU の AI 法(EU AI Act)だけど、Anthropic は公式サポートページで「Claude が提供されている場所すべて、世界中で(wherever Claude is offered, worldwide)」適用すると書いているんだ。EU 向けだけの機能じゃないから、日本で使っていても同じように印が付くよ。
Q.透かしがあると「AIが書いた」とバレるの?
A.そこは公式の説明がハッキリしていて、透かしが示すのは「そのコンテンツは Claude が処理したかもしれない(may have been processed by Claude)」ということだけなんだ。人間が書いた文章を Claude に直してもらった場合にも印は付くから、「AI が書いた証明」にはならないよ。逆に印が見つからなくても「AI を使っていない証明」にはならないと Anthropic 自身が書いているんだ。
Q.Claude の透かしは消せる?
A.消せるけれど、ふつうの手直しでは消えないよ。Anthropic は2026年8月14日の公式ブログで「Light editing probably won't remove the watermark completely; a complete rewrite where every word is replaced will(軽い編集ではたぶん完全には消えない。全部の単語を置き換える完全な書き直しなら消える)」と書いているんだ。つまり語尾を直したり数語を入れ替えたりする程度では残る可能性が高くて、消したいなら全部を自分の言葉で書き直すことになるよ。なお他の場所へコピー&ペーストしても印は文章と一緒に付いていくよ。
Q.Claude で翻訳した文章にも透かしは入る?
A.入るよ。Anthropic は「A translation produced by Claude carries a watermark, because in this case every word is chosen by Claude(Claude が作った翻訳には透かしが入る。この場合はすべての単語を Claude が選んでいるから)」と説明しているんだ。翻訳は元の文が人間の文章でも、出てくる文の単語は Claude が選び直すので印が付く、という理屈だね。
Q.SynthID-Text って何?
A.Google DeepMind が公開した、AI が作った文章に人間には分からない印を入れる方式のことだよ。AI は文章を作るとき、次に置く単語の候補からひとつを選ぶ処理をくり返しているんだけど、SynthID-Text はその「選び方のくじ」の引き方を決まったルールに差し替えることで、単語の並び自体に合図を仕込むんだ。Anthropic は Claude の透かしをこの方式の一種(a version of the SynthID-Text approach)だと説明しているよ。
Q.透かしが入ると文章の質は落ちるの?
A.Anthropic は落ちないとしているよ。公式ブログの表現は「Watermarking does not impact the quality of Claude's output(透かしは Claude の出力の品質に影響しない)」で、変わるのは単語を選ぶときのくじの引き方だけだと説明しているんだ。Google DeepMind の検証でも、印を入れていないモデルとの間に統計的に意味のある差は見られなかったとされているよ。
Q.自分で透かしを確認する方法はある?
A.2026年8月16日の時点では、一般の人が使える確認ツールはまだ配られていないよ。ただし状況は8月14日に一歩進んでいて、Anthropic は仕組みを説明した公式ブログのなかで「We will soon be offering a watermark detection API(透かしの検出APIを近く提供する)」と書いたんだ。提供時期は明示されていないから、いまは「印は付いているけれど、読む手段は順番待ち」という段階だね。
Q.画像の透かしとは何が違うの?
A.今回の主役は文章そのものに埋め込む透かしで、これが新しいところだよ。画像やファイルのほうは .svg / .png / .jpg に C2PA という業界標準に沿った「どこで作られたかの署名付きの記録」を付ける方式で、こっちは OpenAI や Google もすでに採用している仕組みなんだ。
Q.なぜ透かしを入れることになったの?
A.きっかけは EU の AI 法(EU AI Act)だよ。Anthropic は公式サポートページで、EU AI Act 第50条2項の「AI生成コンテンツの透明性に関する行動規範(Code of Practice on Transparency of AI-Generated Content)」に署名したと書いているんだ。第50条の透明性義務は2026年8月2日に適用が始まっていて、AI が作ったものには機械が読み取れる印を付けることが求められているよ。

参考・一次ソース

この記事に出てきた用語・モデル

関連 AI モデル

まとめて読む

このテーマの動きは、時系列で1ページに整理しています。

この記事をシェア

Xでシェア

関連記事

更新を受け取る