OpenAIは10月5日(米国時間)、AIが書いた文章にひそかに目印を残す仕組み「textGrain」を発表しました。EUで提供するChatGPTとCodexでは、全プランの出力に数週間かけて順次適用されます。一方、API利用者は世界中どこからでも任意で有効にできます。背景にはEU AI法の透明性義務があり、文字として見えない透かしがどこまで役に立つのかも注目点です。

文字ではなく「言葉の選び方」に印を残す

textGrainは、文章に特殊な文字や空白を埋め込む方式ではありません。モデルが次の単語を選ぶ際、同じくらい自然な候補が複数あるときに、秘密の鍵にもとづいて選び方を少しだけ偏らせます。1つ1つの単語を見ても違和感はありませんが、ある程度の長さの文章全体を統計的に調べると、その偏りが浮かび上がる仕組みです。

人間の目には判別できず、コピーして貼り付けても消えにくい点が利点です。その代わり、検出には専用のツールが必要になります。

誰にいつ適用されるのか

適用範囲は利用形態によって異なります。

ChatGPTとCodexのEU圏の利用者には、全プランで今後数週間のうちに自動で適用されます。世界共通の初期設定ではなく、あくまでEU向けの対応です。

APIの顧客は10月5日からオプトインで使えます。初期状態ではオフで、プロジェクトや組織の単位で有効にする形です。

検出ツールは一般公開されていません。承認を受けた研究者や専門機関が、申請ベースで利用できる扱いで、受け付けも10月5日に始まりました。透かしは操作されやすいため、検出の手段を広げすぎない方針だとされています。

背景にあるEU AI法の第50条

きっかけはEU AI法の第50条です。生成AIの提供者に対し、出力を機械可読な形で識別できるようにすることを求めており、この透明性ルールは8月2日に施行されました。EUの利用者にサービスを提供する事業者が対象になります。

OpenAIによると、EUの透明性に関する実施規範では、200トークン未満の短い出力やコードの断片には透かしを求めていません。このためコード中心の用途は影響を受けにくく、文章の生成が主な対象になります。

検出精度は編集に弱い

OpenAIが示した数字では、誤検出率を1パーセントに抑えた条件で、200トークンの文章の約80パーセント、400トークンなら約95パーセントを検出できます。ただし、これは手を加えていない理想的な状況の値です。

文章の一部を書き換えると精度は急落します。単語の10パーセントを置き換えると検出率は92パーセントから66パーセントに下がり、25パーセントを置き換えると17パーセントまで落ちます。翻訳や大幅な編集でも検出は難しくなります。また、数式のように表現の自由度が低い文章や、短い文章も苦手です。EU内の言語別では、スペイン語が69パーセントで最も高く、ルーマニア語は42パーセントで最も低かったと報告されています。

これらはOpenAI自身の評価による数字で、第三者による検証はまだ示されていません。

透かしがないことは人間が書いた証拠にならない

OpenAIは、この透かしの限界についても明記しています。透かしは人間がどれだけ関与したかを測るものではなく、著作権などの帰属や責任を示すものでもなく、利用者を特定したり内容の正しさを保証したりするものでもありません。透かしが見つからなかったとしても、人間が書いたことの証明にはならない点を強調しています。

そのため、他社のモデルが書いた文章や、AIの下書きを人が大きく手直しした文章は、検出の対象外になりがちです。教育現場や出版で、検出結果だけを根拠に誰かを判断するのは危ういと言えます。AIで推敲した外国語話者の文章が誤って疑われるのではないか、という懸念も指摘されています。

まとめ

textGrainは、EU AI法への対応として始まった、文章向けの見えない透かしです。EUのChatGPTとCodexには順次適用され、API利用者は10月5日から任意で使えます。ただし、書き換えに弱く、検出ツールも限られた相手にしか渡らないため、AI文章を見分ける万能の手段にはなりません。当面は、規制対応の第一歩として運用がどう広がるかを見守る段階です。