Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#anthropic· × <built-in method clear of dict object at 0xf5f98840ff40>
公開

AnthropicのAmodei CEOがAI開発の減速を提唱、ラボへの第三者監査員の常駐を提案

AnthropicのCEOは、安全対策がAIの能力に追いつくまでフロンティアモデルの開発を「減速させる」計画を発表しました。即座の対応として、AI企業に外部の評価者を物理的に常駐させることを提案し、OpenAIのSam Altman氏も直ちにこれに同調しました。

ステートレスMCP 2.0がセッションを廃止。エージェント統合はよりシンプルで信頼性の高いものに

サイモン・ウィリソンは、Model Context Protocolのステートレスなバージョン2.0への移行を強調しています。開発者にとって、これは複雑なセッション管理の終わりを意味し、モデルに完全な端末アクセスを与えるよりも安全な代替手段となります。

公開

Anthropic、生物兵器に関連する研究者を遮断

Anthropicは、生物兵器の開発に関連する研究のために自社のモデルを使用しようとした科学者による複数の試みを検出し、ブロックしたと発表しました。アクセスを遮断したことは、AIを活用したバイオテロの脅威が理論の領域から抜け出しつつあることを裏付けています。

公開

Anthropicからの実存的リスクによる流出が選好カスケードを引き起こす

ジェイコブ・コクソンがAnthropicを去った後、トップAIラボの従業員たちは、AIによる人類絶滅の可能性が高いと本気で信じていることを公に認め始めました。これらのモデルを購入する企業にとって、これはベンダーが自社製品を長期的に制御する能力を信じていないことを意味します。

Claudeユーザーが生物兵器研究の安全対策を回避

専門家たちは、ClaudeのようなAIモデルの安全策に抜け穴があることを発見し、ユーザーが生物兵器の開発に適用可能な詳細情報を取得できることを明らかにしました。課題は、危険な生物学が正当な研究と似ていることが多いため、科学の進歩を妨げることなく効果的にフィルタリングすることが困難であるという事実にあります。

エージェントが最初の試みで機能する3Dゲームを生成しました

開発者のSimon Willisonは、Claude Fable 5を使用して、単一のテキストプロンプトから3Dブラウザゲームを作成しました。エージェントはロジックを記述しただけでなく、DALL-Eを介してテクスチャ生成を独自に確保し、それ以上の介入を必要とせずにプロシージャルサウンドを作成しました。

公開

Claude Codeが完全自律モードを有効化、エージェントは人間より75%多く危険なアクションをブロック

Anthropicは8月14日から、有料のClaude Codeプランで自律モードをデフォルト設定にします。内部評価によると、人間は危険なコマンドを盲目的に承認しますが、エージェントはほとんどを停止します。

公開
公開

Anthropicの未公開モデルがリーマン予想の研究を前進させる

Anthropicの未公開モデルは、数学者の介入なしに60のエージェントを使用して650のアイデアをテストし、リーマン予想の境界を前進させました。これは、エージェントネットワークの計算能力が科学的ブレークスルーに十分になり始めていることを示しています。

公開

弱いモデルがより強力な兄弟モデルの隠された思考を漏洩させる

研究者たちは弱いモデルを悪用して、最も強力なモデルから隠された推論プロセスの痕跡を抽出した。これは、モデルの推論を暗号化されたブロックに隠す試みが今のところほとんど幻想であり、意図せず704件のプライバシー関連の記録を暴露していることを示している。