見出し画像

Claudeの「透かし」が入る公式発表にネット騒然

Claudeの「透かし」は、AIが書いた証拠なのか

※本記事は、当方ブログの要約です。全文は以下をご参照ください。
https://shinichi.noguchi.jp.net/blog/2026-08-13-claude-watermark.html

Claudeの文章に「透かし」が入る——そんな話題を見て、「これでAIが書いた文章を完全に見分けられるの?」と思った方へ。

実際には、話はもう少し複雑です。Anthropicが発表したマーキングは、文章をゼロからAIが書いたことや、人間がまったく関わっていないことを証明するものではありません。人が書いた文章をClaudeに誤字チェックや翻訳だけしてもらった場合にも、同じような信号が付く可能性があります。

信号というのは、本来Claudeが選択すべき単語を避け、人間にはわからない自然な日本語で若干、所定のロジックでずらして表現すること、そしてそのずらしポイントがある一定の割合で発生している場合に「透かし」と判定するもののようです。
例えば本来ユーザーに何か頼まれたとき「はい。では私が担当します」と答えるところを「はい。では私で担当します」のように変化させる。日本人はこの差に気づかないがAIは、なぜ「が」ではなく「は」を選んだかの違和感のロジックに気づく。そしてそのような違和感を本文中に何か所も確認すると、それを透かしとみなす。本来はこんなに単純なはなしではないが、小学生向けに話すとこうなるだろう。

逆に、透かしが見つからなかったからといって、AIが使われていないとも言えません。短い文章、大幅な書き換え、翻訳、画像の再保存などで信号が消えることがあるからです。

この記事では、テキストに埋め込まれる不可視のマーキングと、画像などに使われるC2PAという来歴情報の違いを、専門用語をかみくだいて整理します。EU AI法との関係や、検出結果を仕事や学校の判断に使うときの注意点も紹介します。

大切なのは、「AIが書いたかどうか」を一つの検出結果だけで決めないことです。どのように作られたか、誰が確認したか、編集の記録が残っているか。透かしは、その証拠の一部にすぎません。

参考URL:

※2026年8月13日時点の情報に基づいています。公式資料や検出器の仕様は今後更新される可能性があります。

いいなと思ったら応援しよう!