Anthropic透かし除去ツールが拡散
- •AnthropicがClaudeの不可視テキスト透かし計画を発表後、開発者らが除去ツールをオンライン投稿した
- •Wiredによると、ギヨーム・メイヤー(Guillaume Meyer)のGitHub上の上書きツールには100人超の貢献者が集まった
- •EU AI法第50条2項は機械検出可能なラベルを義務づけ、最大3 per centの制裁金を認める
開発者らは2026年8月、Anthropicが将来のClaudeモデルの出力に機械可読の印を埋め込むと表明した後、AI生成テキストから不可視の透かしを除去すると主張するツールをオンラインに投稿し始めた。The Indian Expressは2026年8月23日、ニューデリー発で、機械生成コンテンツにラベルを付ける動きは、透明性を求める規制当局と検出回避を試すプログラマーのいたちごっこになっていると報じた。
Anthropicは、Claude Codeの出力を含む対応Claudeモデルのテキストに、Claudeの応答の意味、品質、読みやすさを変えない不可視の透かしを入れるとしている。同社はWiredに対し、EU AI法に準拠するためClaude出力に印を加えており、利用者向けにテキスト検出APIを公開する計画だと述べた。
Wiredによると、ギヨーム・メイヤー(Guillaume Meyer)の透かし上書きツールにはGitHubで100人超の貢献者が集まり、さらに複数のダウンロードにつながった。Anthropicの発表後、同様のツールがオンラインに現れ、開発者らはAI生成コンテンツ、特にテキストから知覚できない透かしを除去できると主張している。
Anthropicは、自社の透かしが示すのは、Claudeがある時点でコンテンツ処理に「likely」関与したということであり、Claudeが全文を書いたことではないと認めている。この透かしは「Claude wrote this」と「Claude heavily edited this」を区別できず、テキストが人間によって書かれたのか、別企業のAIモデルによって生成されたのかも証明できない。
報道で引用された批判者らは、透かしと検出の広範な利用が偽陽性を生む恐れがあると警告した。検出器が作品をフラグ付けした場合、雇用主が候補者を拒否したり、研究者や学生がAIツール使用について過大な非難を受けたりする懸念がある。
Anthropicの透かし導入は主に、2026年8月2日に施行された欧州連合のEU AI法第50条2項と結びついている。同規則は、AIモデル提供者に対し、合成音声、画像、動画、テキストを機械がAI生成物として検出できるようラベル付けすることを求め、回避ツールの販売を禁じ、違反には年間売上高の最大3 per centの制裁金を認める。
AnthropicはOpenAI、マイクロソフト、Metaを含む190超の組織とともに、EUの透明性に関する行動規範にも署名した。同社の手法はGoogle DeepMindのSynthID-Textに基づき、人間には気づけないが機械には検出できる隠れたパターンを単語やフレーズの選択に残すことで、2023年からAI生成コンテンツの透かし付けに使われてきた。
メイヤーに帰される初期の回避策は、透かしを入れないAIモデルを使って複数の書き換えを作成し、類義語を入れ替え、文章をわずかに再構成する。報道によれば、この方法は透かしを挿入しないAIモデルでのみ機能する可能性が高く、Anthropicが検出ソフトウェアを公開するまではClaudeの透かしを除去できるかどうか確実ではない。
ほかの開発者らは、不可視文字や見た目が似た文字を削除し、段落内の文の順序を変え、複数の単語を類義語に置き換えると主張するツールを構築した。オックスフォード大学の客員フェロー、レオン・クロン(Leon Chlon)は、Claudeの応答を要約し、アラビア語のような方言に翻訳してから元に戻すことでも透かしを除去できると述べた。