Anthropicは、今月からClaudeの生成テキストに埋め込み始めたウォーターマークについて技術解説を公開した。限界の説明が異例なほど率直だ。軽い編集ではおそらく消えないが、「すべての単語を置き換える完全な書き直しであれば消える」と同社は述べる。短い文章では検出がうまく働かない。語の選択肢が少なければ、読み取れる信号も少ないからだ。事実を述べる文章やコードでは埋め込みがまばらになる。そこでは、誤りにせずに同じ内容を言い換える余地がもともと乏しいためだ。文書を渡して文法と句読点だけ直すよう頼めば、ウォーターマークはそのわずかな修正箇所にしか宿れず、検出に足りない場合がある。陽性判定の意味も明記されている——Claudeがその文章の生成に関与した可能性が高い、ということであって、人間が書いていないという意味ではない。