Lilith Lilith.
⌕
編集イラスト: AIラボ関係者12人が危険を警告、それでも共通の処方箋はない
Lilithのイラスト · 編集リミックス

Palisade Researchのfrominside.aiは、OpenAI、Google DeepMind、Anthropicの現職または元関係者12人へのインタビューを公開した。人類絶滅の確率を数十パーセントと見る発言もあるが、シリーズ全体から統一診断や開発を管理する共通計画は生まれていない。

研究者が極端なリスクに顔と数字を与える

OpenAIとGoogle DeepMindに在籍したGeoffrey Irvingは、人類絶滅の確率を約50 %と見積もった。Google DeepMindのNeel Nandaは少なくとも10 %と述べた。Daniel Kokotajloは、超知能システムを制御する方法を人類は知らず、その状況を許してはならないと語った。

サイトには12本の公開済み完全版インタビューと、テーマ別の編集動画がある。参加者は主要3ラボの現職と元職員だ。Palisadeは22本を撮影し、一部は参加者が後に許可した場合のみ公開すると説明する。発言は個人の見解であり、勤務先の公式見解ではない。

最も重いメッセージは競争の内側にある葛藤だ

この企画が映すのは、仮想的なシステムへの恐怖だけではない。リスクを極めて大きいと考えながらラボに残る人々がいる。Nandaは、自分の仕事が存在リスクを直接減らすと信じられなければ辞めると話す。一方、社内の約束を信用できなくなったり、政府の監督が必要だと考えたりして退職した人もいる。

これはAI企業のgovernance問題でもある。安全研究者はリスクを減らす一方、開発継続に正当性を与えることもある。社会は、より強力なシステムを販売する企業から給与を受ける人の警告を聞く。Mary Phuongは、ラボに雇われている自分の発言を疑うべきだと述べ、この緊張を率直に示した。

12本のインタビューは業界全体の調査ではない

Palisadeは、参加者が代表性のある標本ではないと明記している。自らの人脈を通じて参加者を探し、重大なメッセージがあると考える人ほど応じやすかった。安全チームとfrontier開発の減速を支持する人が多く含まれる。

一人が示す正確な割合も、確率の測定値ではない。観測可能な事例列を持たない、調整済みまたは未調整の個人的判断だ。動画は、主要ラボの内部に懸念があり、一部の専門家が深刻に受け止めていることを示す。50 %が正しい推定だとも、全研究者が同じ見方だとも証明しない。

具体的な制度提案がインタビューの重みを決める

次の段階では、懸念を検証可能な意思決定へ変える必要がある。高能力モデルの導入規則、独立evals、事故報告、内部批判者の保護、開発やreleaseを止める明確な権限が含まれる。こうした仕組みがなければ、最も鋭い証言も共有されやすい動画に留まる。

今後見るべきなのは、現職者が退職や規制当局の介入要求につながる具体的な境界を示すかどうかだ。その境界が、個人的な不安と、職業上の代償を引き受ける覚悟を分ける。

Lilithの判定

カメラは、競争の内側からコースの先は崖だと叫ぶ人々を映した。次に見るべきは、誰がブレーキへ手を伸ばすかだ。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗ ↗