Lilith Lilith.
編集イラスト: セキュリティ研究者がClaudeを利用してOpenAIのシステムに侵入
Lilithのイラスト · 編集リミックス

AIがライバルのAIラボをハッキング

3人のセキュリティ研究者が、OpenAIのコミュニティフォーラムの脆弱性を悪用し、同社の内部システムを侵害することに成功した。彼らは従業員のChatGPTアカウントを乗っ取り、機密性の高いソースコードへのアクセス権を獲得した。この攻撃で注目すべきなのは、エクスプロイトそのものではなく、その手法である。研究者たちはAnthropicの競合モデルであるClaudeの支援を受けて作戦全体を実行し、Claudeは72時間以内に脆弱性を連鎖させ、セキュリティ対策を回避する手助けをした。

オフェンシブセキュリティアシスタントがゲームを変える

セキュリティチームにとって、これはAIモデルが提供する攻撃能力の急激な変化を示している。Claudeは単なる構文検索エンジンとして機能したわけではない。研究者たちは、ターゲットアプリケーションの構造を理解し、古いモデルでは解明できなかった特定の攻撃ベクトルを設計するための分析パートナーとしてClaudeを利用した。これにより、欠陥を発見して悪用するために必要な時間と高度な技術的専門知識が劇的に削減される。

攻撃の加速が防御を上回る

攻撃的なAI利用の現実は、現状ではモデルが防御側よりも攻撃側をはるかに助けているということだ。OpenAIのようなトップクラスのラボでさえ、競合他社のAIモデルの支援を受けた攻撃から自社の境界インフラストラクチャを保護するのに苦労していることは明らかだ。防御にはシステム上の完全無欠さが求められるが、侵入にはモデルの助けを借りていくつかの忘れられた設定ミスを見つけるだけで済む。

社内開発の保護へのプレッシャー

この事件は、ラボの開発者ツールやフォーラムが、本番環境の研究データやアカウントから最終的に隔離されるかどうかを明らかにするだろう。モデルの安全性に関するホワイトペーパーが増えることではなく、ラボがコミュニティサイトと社内GitHubリポジトリの両方でシングルサインオン(SSO)を使用するのをやめるかどうかが、その証明となるだろう。

Lilithの判定

トップクラスのAI企業のソースコードが、競合他社のモデルの助けを借りて、フォーラムの脆弱性を通じて流出する。開発者に必要なのは更なる超知能ではなく、本番サイトとコミュニティサイトを最終的に隔離することだ。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗