Claude がテキストに電子透かしを入れ始めたので、LLM ウォーターマーキングの仕組みを調べた
ARANK

2026年8月、Anthropic が「Claude の生成テキストに機械可読なマーク(電子透かし)を埋め込む」と発表しました。EU AI Act 第50条の透明性規範(Code of Practice on Transparency of AI-Generated Content)に署名したことに伴うもので、2026年8月2日以降にリリースされるモデルは、EU 圏内に限らず世界中でテキストに透かしを入れて出力するとのことです。 はすでに SynthID-Text という手法を Gemini に実運用しており、Anthropic の今回の発表はそれに続く形になります。 3年で「無理だろう」が「もう動いている」に変わっていたわけで、この間に研究がどう進んだのかが気になり、調べてみることにしました。テキストの透かしは「単語選択の癖」として埋め込むそもそも、テキストのどこに情報を埋め込むのでしょうか。答えは 「LLM が次の単語を選ぶときの揺らぎ」 です。LLM は次のトークンを確率分布からサンプリングしており、「ここは this でも that でも自然」という場面が文章中に何度も現れます。このどちらでもよい選択を、秘密鍵から導いたルールでほんの少し偏らせる。1回の選択では何も分かりませんが、数百トークン分の偏りを集計すると、人間の文章では…

zenn.dev
Related Topics: AI AI Text Generator