Lilith Lilith.
編集イラスト: 不可視の電子透かしはテキストの真正性を証明するものではなく、AI法を遵守するだけだ
Lilithのイラスト · 編集リミックス

欧州の鞭がインフラを統合する

Anthropicは、Claudeモデルによって生成されたテキストに不可視の電子透かしを追加し始めると発表した。この動きは、合成コンテンツに機械可読なラベル付けを義務付ける欧州連合のAI法に基づく義務への対応である。規制により、競合する企業は同じツールに手を伸ばさざるを得なくなっている。AnthropicがGoogle DeepMindのオープン技術であるSynthIDアプローチのバージョンを使用しているのは偶然ではない。Google自身も2024年からGeminiにこれを導入している。

統計は防弾ではない

この方法は見えないインクのように機能するのではなく、重要度の低い単語の確率を統計的に調整するものだ。たとえば、モデルが曇りと灰色のどちらの単語を選ぶかなどである。これにより、APIの価格や回答の実用的な品質に影響を与えることなく、テキストに特定のパターンが刻印される。ただし、そのような電子透かしは、変更されていないテキストの長いブロックでのみ生き残る。本質的に堅牢であることは不可能だ。

すべての編集が痕跡を破壊する

ユーザーがコピーした段落を削除したり、いくつかの単語を書き換えたり、言い換えのために別のモデルを実行したりした瞬間に、検出信号は確実に壊れる。ラベル付けは、自動化されたスキャナーがウェブ上の大量の生のゴミをキャッチするのに役立つが、意図的な偽造を止めることはできない。文書が法廷、選挙、または企業の意思決定に影響を与えることを意図している場合、それを生成する人は常に5分かけて目に見えないパターンを上書きするだろう。

共有キーが監督の意志を示す

将来の主なシグナルは、他のモデルへのSynthIDの導入自体ではなく、市場が統一された検出APIに合意するかどうかだ。OpenAI、Anthropic、Metaが中央集権的な検証なしにそれぞれ独自の検出器を構築した場合、ユーザーはテキストをいくつかの異なるチェックにかける必要がある。電子透かしの成功は、誰がより複雑な乱数生成器を発明するかではなく、逆説的に共有の読み取りキーに依存している。

Lilithの判定

官僚的なチェックボックスにはチェックが入った。あとは、不可視のテキスト電子透かしは、バックスペースキーと類語辞典を持ったインターンでも破ることができるということを当局に説明するだけだ。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗