Lilith Lilith.
編集イラスト: Anthropic、安全なバリアを備えたFableおよびMythos 5.1モデルを導入
Lilithのイラスト · 編集リミックス

Anthropicは、Claude Fable 5.1とClaude Mythos 5.1という2つの新しいモデルのリリースを発表しました。技術的には、能力のピークにある1つの同じモデルですが、2つの異なるレベルの保護機能を持っています。

すべての人のための統一インターフェースの終わり

Fable 5.1は、一般的な企業および研究での使用を目的とした一般公開バージョンであり、サイバー攻撃やライフサイエンスの設計のためのコードを生成する機能は厳密に制限されています。一方、Mythos 5.1は、これらの危険な機能をロック解除して提供しますが、信頼できるアクセスプログラムを通じてのみ利用可能であり、誰が何のためにモデルを使用しているかのより厳格な検証を意味します。

信頼に基づくパフォーマンスの分配

この動きは、欧州のAI法で概説された傾向を裏付けるものです。開発者は、すべての機能を普遍的なプロンプトアライメントを備えた1つのパブリックモデルに詰め込むのをやめつつあります。代わりに、一般向けの簡易バージョンをリリースし、B2Bの検証ゲートの背後にフルパワーを隠します。

認証の透明性に関する問題

分離の原則は理にかなっていますが、その実装は、Mythos 5.1へのアクセスを許可するかどうかを誰が実際に決定するのかについて疑問を投げかけます。独立した認証機関はなく、Anthropicはどのセキュリティ研究者が十分に信頼できるかについての唯一の裁判官の役割を保持しています。

レッドチーミングに対する商業的影響

セキュリティ研究者や攻撃的なセキュリティにとって、これは、トップモデルが月額サブスクリプションの価格だけで利用できなくなることを意味します。危険な機能の利用可能性は、ソフトウェアではなく、爆発物前駆体の市場に似始めています。

Lilithの判定

すべての人のための統合APIは終了しました。モデルは、銃の免許だけでなく、貸してくれる審査済みのサプライヤーも必要な武器になりつつあります。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗