Lilith Lilith.
⌕
編集イラスト: Google、cyber guardrailsを外したGemini 4 Argonを審査済み防御者に限定
Lilithのイラスト · 編集リミックス

Gemini 4 ArgonはまずFairwind Programを通じて選ばれたcyber防御者に提供され、Googleはcyber guardrailsを外した版を渡す方針だ。限定公開は安全性の試験であると同時に、最も強い能力を誰が使えるかを供給者が決める新たな権限も示している。

Fairwindは一般顧客より先に完全なcyber能力を得る

Googleは2026年9月30日、coding、knowledge work、cyber防御の長時間作業に向けたfrontier modelとしてArgonを発表した。最初に利用できるのはFairwind Programで選ばれた信頼できるcyber防御者だ。Googleはこれらの組織と自社の内部チームにcyber guardrailsを外したArgonを提供し、防御能力を最大限使えるようにする方針である。

Googleによると、モデルは脆弱性を自律的に発見し、確認し、修正できる。公開leaderboardに基づくCWE-bench v1の成績は68 %で首位タイだった。WizはScan for GoodでArgonを使い、世界の病院が利用する医療softwareで機密性の高い個人情報が露出する重大な脆弱性を見つけたとGoogleは説明する。脆弱性の詳細は公表されていない。

Googleは米国政府による公開前モデルアクセスの任意手続きにも参加している。初期testerの意見を集め、保護策を強化した後に対象を広げる計画だ。有料API顧客とGoogle AI Ultra加入者への提供日は発表していない。

利用者名簿そのものがsecurity architectureになる

通常の製品では、顧客組織内の権限管理がriskを抑える中心になる。ArgonではGoogleがもう一段前に入り、モデルを受け取る組織自体を選ぶ。全員へ同じ制限のモデルを提供するのではなく、誰を信頼し、どの目的を認めるかによって能力を配分する仕組みだ。

security teamにとって先行利用は発見と修正の迅速化につながり得る。一方で、Googleが信頼をどう判定するのか、アクセスをどう取り消すのか、誰が利用をauditするのか、米国外の企業にも同じ参加経路があるのかという問題が生じる。発表は基準を説明していない。

攻撃と防御の能力は同じengineを共有する

脆弱性を発見してproof of conceptを作れるモデルは、管理者にも攻撃者にも役立つ。GoogleはcyberとCBRNの悪用対策、間接的なprompt injectionへの耐性、内部activationの監視、chain of thoughtと行動の監督を挙げている。モデルが利用者の意図から外れた場合は実行を止める設計だ。

耐性に関する主張の多くはGoogleとpartnerの試験に依存する。一部の評価では内部datasetと独自harnessが使われた。選ばれた利用者についてcyber guardrailsを意図的に外す以上、組織の審査と運用監督は、通常のmodel refusalより重い役割を担う。

事故と参加基準が管理型アクセスの代価を示す

次に見るべきものは対象拡大だけではない。GoogleはFairwindの参加基準、audit要件、アクセス取消手続き、incident報告規則を示す必要がある。詳細がなければ、安全基準なのか非公開のpartner名簿なのかを外部から判断できない。

発見した脆弱性を悪用前に安全に修正できた件数も重要だ。重大incidentを起こさず修正を速めたことをGoogleが示せば、限定rolloutの根拠になる。示せなければ、信頼できる防御者というbadgeは供給者自身が印刷したものにとどまる。

Lilithの判定

Googleはいま名簿を手に武器庫の前へ立ち、より鋭い道具を誰へ渡すか決めている。公開ルールがなければ、信頼済みという言葉は供給者が自分で押す判子にすぎない。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗ ↗