AI が生成した文章に埋め込まれる見えないテキスト透かし(ウォーターマーク)。
このパターンを破壊・回避する方法について。
そもそもこの透かしとは、簡単に言うと、
単語や文法において「似た意味だが表現が違う」という物を、A群とB群に分けておき、
AとBがどういう順番で登場するかを AI があらかじめ決めている。
一見普通の文章に見えるが、AB判定ツールを通すことで、
無秩序かパターンがあるかが分かり、AI 生成文章かどうかが分かる、という仕組み。
では具体的な回避方法について。
これらは数学的に証明されているが、あくまで確率の話なので、
ほぼほぼ成功するが奇跡の一文が無い事を保証するものではない。
なお、方法は全て日本語で生成されたものを対象とする。
1.
生成された文章から、6字以下の連続した文字列を、1文字以上間隔をあけて取り出していき、
順番はそのままで連結させていく。 ただし、元の文章の40%までしか取り出すことはできない。
2.
生成された文章の、50%の文字、文法を書き換える。
単語を同じ意味の別の単語に置き換えただけでは一切影響は出ない。
目的語の位置を変える、展開する文章の順番を入れ替える、などを織り交ぜる必要がある。
人力で行うのは大変だが、変換ツールが出回っている。 日本語対応も存在している。
3.
日本語で生成されたものをコピーし、英語に翻訳させる。
これをコピーし、日本語に翻訳させる。 通称、往復翻訳。
中間言語は英語が望ましい。 目的語の位置が異なるため文法パターンを破壊しやすく、
また翻訳データが豊富なため意味を保持したままの翻訳がしやすいため。
これはほぼ確実に透かしを回避できる。 ただし、翻訳 AI の透かしは完全に挿入される。
生成 AI の判定を回避するだけならば、これが一番手軽にできる。
学校の課題や仕事の資料などで活用してほしい。