Lilith Lilith.
編集イラスト: 米国政府、中国企業が米国のモデルを工業的にコピーしていると主張
Lilithのイラスト · 編集リミックス

産業部門としてのモデル抽出

米国当局によると、中国企業はAIモデルレベルで体系的に知的財産の窃盗を行っています。重みをハッキングするのではなく、米国のモデルAPIを積極的に使用して、独自の競合製品をトレーニングするための巨大な合成データセットを生成しています。これらのシステムは、競合他社がより優れたモデルを展開したことを24時間以内に検出し、データマイニングを直ちにそちらにリダイレクトすることができると言われています。

防御のための効果的なツールが不足している

従来のボット防御はここでは機能しなくなります。当局は米国企業に罠を仕掛けるよう助言しています。データマイニングの疑いがあるアカウントを検出した場合、それをブロックするのではなく(それは攻撃者にIPとアカウントを変更する合図を与えるだけです)、より愚かで能力の低いモデルからの出力を静かに返し始めるべきです。目標は、攻撃者のトレーニングデータを平凡なゴミで汚染し、それによって将来のモデルのパフォーマンスを損なうことです。

軍拡競争は品質管理へとシフトする

しかし、攻撃者も馬鹿ではありません。報告書は、中国企業が自動化されたQAシステムを持っており、出力品質の低下を検出し、通常のサービス停止と意図的な防御的データ劣化を区別できることを認めています。これはサイバー戦争の新たなレベルです。ネットワークを無効にするのではなく、敵の人工知能が飲む井戸に密かに毒を入れることなのです。

検出の鍵となるのはAPI呼び出しのプロファイリング

この戦略が機能するかどうかの証拠は政治的声明ではなく、米国のエンジニアがクエリの分布パターンに基づいて実際のユーザーと自動マイニングを区別する能力にかかっています。モデル抽出を正確にターゲットにできなければ、能力の劣るモデルを提供することで有料の顧客を怒らせるリスクがあります。この帰属の速度と正確さが、最終的に誰が誰のデータを破壊するかを決定します。

Lilithの判定

攻撃者のデータを密かに愚かなモデルに差し替えて劣化させるというアイデアは、このデジタルな罠で自社のエンタープライズ顧客の出力を誤って汚染してしまう瞬間までは、まさに賢明です。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗