OpenAIは今後数週間以内に、欧州連合内の対象ユーザー向けにChatGPTとCodexが生成するテキストへの不可視の電子透かしの追加を開始する。これは欧州AI法に定められた透明性規則への準拠を目的とした措置である。導入対象にはすべてのプランが含まれるが、開始時点でテキストへの電子透かし付与が世界共通のデフォルト設定になるわけではない。
透明性規則は8月2日に適用開始となり、AI企業に対して、他のシステムが認識できる方法で自動生成コンテンツを識別することを義務付けている。一方、OpenAIのAPIを利用する開発者は、世界のどこにいても、今すぐ特定のモデルでこの機能を有効にできる。ただし、デフォルトでは無効になっている。
電子透かしはどのように機能するのか?
電子透かしは記号や目に見える警告として表示されるのではなく、モデルが提案する単語の選択を微調整することで生成される。この調整によって、専門の検出ツールが検出できるパターンが残り、テキストをコピーして貼り付けてもそのパターンはテキスト内に保持される。OpenAIによると、電子透かしによってユーザーの身元が明らかになることはなく、同社のテストでは有効化してもモデルの性能に意味のある変化は生じなかった。
OpenAIは同時に、同社とペンシルベニア大学、イェール大学の研究者が作成した、textGrainと名付けられた手法に関する技術報告書を公開した。報告書によると、この手法は秘密鍵を使って文の続きを生成する際の次の単語の確率を並べ替え、こうした調整を数百回集積することで、テキストと鍵を用いて検出器がパターンを検出できるようにする。
編集後の検出の限界
電子透かしは、すべてのケースでテキストの出所を決定的に示す証拠となるわけではない。OpenAIが実施したテストでは、単語の10%を同義語に置き換えると、検出率は約92%から66%に低下した。また同社は、短い文章、数学の回答、翻訳されたテキストは検出がより難しいことを確認した。
OpenAIは、電子透かしがないことは、そのテキストを人間が書いたことの証明にはならないと注意を促している。テキストが短すぎる場合や、大幅な編集を受けた場合、または他社のAIシステムによって生成された場合があるためだ。また、電子透かしが存在していても、OpenAIのシステムが文章の一部を生成または処理した可能性を示すだけで、その作成に人間の判断、編集、創造性がどの程度関与したかを特定するものではない。
なぜこのニュースが重要なのか?
今回の導入により、欧州の組織はChatGPTとCodexのコンテンツを調査するための追加の技術的手段を得ることになるが、これだけでテキストの出所を証明する問題が解決するわけではない。編集、翻訳、テキストの長さの影響を受けやすいことから、検出結果には慎重な解釈が必要となる。そのためOpenAIは、検出ツールへの初期アクセスを、信頼性と責任ある利用方法を評価する認定研究者および専門組織に限定した。
この措置は、Anthropicが2か月前にClaudeが生成するテキストへの電子透かしを世界規模で付与すると発表した後に行われた。この決定には、一部のユーザーから異議が唱えられた。指示や文脈、判断への自分たちの貢献を踏まえると、Claudeは著者ではなくツールだと考えたためである。The Wall Street Journalが2024年に報じたところによると、OpenAIは以前にもテキストへの電子透かし技術を開発していたが、電子透かしを使用しない競合他社へユーザーが移行する懸念から、その公開を控えていた。