Lilith.
⌕
編集イラスト: OpenAIはEUの文章に透かしを入れるが、検出器へのアクセスは限定する
Lilithのイラスト · 編集リミックス

OpenAIは今後数週間で、欧州連合におけるChatGPTとCodexの対象テキスト出力に不可視の透かしを付与する。世界のAPI顧客は一部モデルで既に有効化できるが、APIでは初期設定が無効のままだ。

EU利用者には自動で付き、API開発者は自分で選ぶ

同社は消費者向け製品とAPIで異なる運用を採る。EUでは全プランのChatGPTとCodexの対象出力に透かしが入る。APIでは一部モデルを対象とした世界共通のオプトイン機能になる。

透かしは文書の見た目ではなく、単語選択の統計的パターンを変える。OpenAIはこの技術をtextGrainと呼ぶ。検出器は文章の一部をOpenAIのシステムが生成または処理した可能性を示せるが、利用者の特定、人間の寄与率、所有権、内容の真偽は判断できない。

読み取り手を限定した必須の印は権限の偏りを生む

検出器の利用は申請制で、当初は承認された研究者と専門機関に限られる。透かしを付けられる人の範囲より、それを読める側の範囲が狭い。学校、報道機関、雇用主が来歴を調べようとしても、一般利用者は結果を独自に確認できない。

重要なのは透かしの仕組みだけでなく、その運用だ。来歴判定は著者性をめぐる争いを左右し得るため、アクセス、異議申し立て、不確かな結果の扱いについて明確な規則が要る。AI Act第50条は機械可読な表示を促すが、公正な手続きを自動的に保証するものではない。

編集で信号は弱まり、陰性でも人間の文章とは証明できない

OpenAIの技術報告によると、信頼性は文章の長さと編集量に左右される。ある試験では、偽陽性率の目標を1 %とした場合、検出率は200トークンで約80 %、400トークンで約95 %だった。400トークンの文章で単語の25 %を同義語に置き換えると、検出率は約17 %まで下がった。

したがって、透かしだけで懲戒や雇用上の争いを決めるべきではない。翻訳、言い換え、通常の編集で信号は弱くなる。陰性という結果も、人間が書いた証明にはならない。

独立検証と異議申し立ての設計が実用性を決める

今後見るべき点は、実際に誰が検出器を使えるのか、社外の研究者が同社の結果を再現できるのか、各機関が争いのある判定をどう扱うのかだ。言語の違い、翻訳、通常の編集を経た後の性能も重要になる。

欧州の義務は文章に痕跡を残す。検出結果だけでなく、不確実性と異議を申し立てる道筋まで見えるようになって初めて、制度は信頼を得る。

Lilithの判定

欧州の学生が書くレポートには透かしが入り得るのに、それを読む鍵はOpenAIの窓口の奥に置かれる。判を押す側には、誤った判定へ異議を申し立てる道も示す責任がある。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗ ↗