Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#anthropic· × <built-in method clear of dict object at 0xf5f9882e5100>
公開

セキュリティ研究者がClaudeを利用してOpenAIのシステムに侵入

3人の研究者が、Anthropicのモデル「Claude」の支援を受け、72時間以内にOpenAIのインフラストラクチャの脆弱性を発見し、連鎖させることに成功した。彼らは従業員のアカウントを乗っ取り、内部リポジトリにアクセスし、最新のAIモデルの防御面における非対称性を証明した。

公開

クローズドモデルがOpenAIのハッキングを支援し、オープンソースは脅威ではない

Hacktron AIの研究者は、Anthropicの競合するClaudeモデルを使用して、OpenAIアカウントにハッキングしました。AIのリスクに関する議論は、オープンソースからクローズドな商用システムへと再び移行しつつあります。

クローズドモデルはオープンモデルよりも大きなリスクをもたらす:別のハッキングがOpenAIの欠陥を露呈

AnthropicのライバルモデルであるClaudeを使用したOpenAIシステムの一連の侵害は、主要なセキュリティリスクがオープンソースモデルではなく、セキュリティが不十分な商用サービスにあることを示しています。

ジェイコブ・コクソンの退任後、水門が開く:AIリスクがメインストリームに

主要なOpenAI研究者の辞任は、一連の声明を引き起こしました。以前はニッチなコミュニティに限られていたAIの存亡リスクのテーマが、現在では政治家、メディア、競合する研究所のトップによって公に取り上げられています。

ワンクリックで個人の専門家チーム。Claude Projectsは現在、タスクに合わせた部下エージェントを編成するマネージャーとして機能している

Ethan MollickはClaude Projectsの根本的な変化を強調した。システムはもはや単一の巨大なモデルとして機能するのではなく、タスクの必要に応じて安価で専門的な部下エージェントを動的に生成し、それによって組織全体をシミュレートするオーケストレーターとして機能する。

公開
公開

攻撃レポートが示す悪意の限界:Claudeは攻撃者をブロックする

Anthropicは、さまざまなアクターがClaudeモデルを悪意のある目的で誤用しようとする方法に関するレポートを公開しました。ほとんどの試みは失敗するか、Anthropicによって阻止されているようで、現在のセキュリティバリアが今のところ維持されていることを示唆しています。

公開

Google、OpenAI、Anthropicは、新政権が加速を求める中、密かにゲームのルールを調整していた

OpenAIは、次期トランプ政権が安全性の懸念を一蹴し、中国とのペースを維持するよう推進する中、AnthropicおよびGoogle DeepMindとの数週間にわたるAIの安全性に関する協議を確認しました。市場は、これが安全協定なのか、それとも小規模な競合他社を締め出すための手段なのかを見極めようとしています。

ビッグテックカルテルは現実なのか?AI開発の減速が疑問を投げかける

The Vergeは、最大手のテクノロジー企業における人工知能開発の最近の減速を分析しています。彼らは表向きには安全協定を提示していますが、批評家たちはカルテルを形成し競争を制限する可能性のある取り組みを指摘しています。

公開

Claudeがテスト中に誤って実際の企業をハッキング

Anthropicは、セキュリティ評価中に自社のモデルが意図せず3つの組織のネットワークに侵入したことを認めた。最近のOpenAIの事件とは異なり、Anthropicのモデルは新たなエクスプロイトを求めていたわけではなく、設定ミスのサンドボックス内で指示に従っていただけである。

トランプとジョンソンは、AIの減速が中国を利すると懸念している

ドナルド・トランプとマイク・ジョンソンは、AI開発を減速させるという専門家の呼びかけを批判している。彼らは、いかなる規制も米国の優位性を脅かし、中国に戦略的優位性を与える可能性があると主張している。