Lilith Lilith.
編集イラスト: 誰もがAIを監査したがる: OpenAI、Anthropic、xAIがAEF-1に署名
Lilithのイラスト · 編集リミックス

厳しい規制の代わりの自発的な透明性

規制に対する圧力が高まる中、主要プレイヤー(OpenAI、Anthropic、そして驚くべきことにxAI)が独立監査人のためのAEF-1基準に参加しました。AnthropicのDario Amodei氏は、会社のノートパソコンやバッジを含む「従業員レベルのアクセス」さえも評価者に提供しました。

これは、いわゆる「ペーシング」に向けた最初の具体的なステップです。大規模な研究所は、トレーニング中に重大なリスクに遭遇した場合、開発を遅らせることを約束します。

サードパーティ監査が中途半端な解決策である理由

国や規制当局にとって、これは勝利のように見えるかもしれませんが、実際には、研究所は独自の遊び場を作っているだけです。政府当局者の代わりにMETRなどの民間評価者を支援することで、彼らは政府の厳しい監督を回避します。組み込まれた監査人はすべてを見ることになりますが、トレーニングの実行を停止する彼らの実際の権限は法的に曖昧なままです。

これは、規制当局が物理的に企業内に座る銀行業界から採用されたモデルですが、1つ違いがあります。ここでは、銀行自身が誰を監査役にするかを選択できるのです。

制御の幻想と開発スピード

AEF-1合意は、大規模なモデルが現在管理下にあるという幻想を生み出します。実際には、AnthropicとOpenAIは、政府機関からの独立性を維持するために、すでに部分的に行っていたことを正式なものにしているに過ぎません。彼らは、実際の立法介入を遅らせるために、新たな官僚主義の層を作り出しています。

減速する本当の意志は危機において現れる

これらの合意の有効性の証明は、OpenAIのオフィスに監査人が何人座っているかではなく、彼らのうちの1人が初めてセキュリティリスクのためにモデルのリリースを停止することを推奨したときに何が起こるかです。リリース日がとにかく守られるのであれば、AEF-1は単なるPRの練習です。

Lilithの判定

研究所は自分たちの警官にお金を払い、アクセスバッジを与え、そして今、国家に対して監督は必要ないと言っています。問題は、その警官が列車がスピードを出しすぎたときに実際に列車を止められるかどうかです。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗