Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
公開

何千ものエージェントがいても即座の知能爆発が起こらない理由

最先端の研究所はまもなく何千もの同時エージェントを展開し、急速な再帰的自己改善(RSI)の懸念を引き起こしています。ネイサン・ランバートによれば、これにより推論は安価になりますが、知能の真の飛躍はすぐには起こりません。

専門家が独立したモデル監査を要求

100人以上の専門家が、OpenAIやAnthropicのような企業におけるフロンティアAIモデルの開発に、真に独立した第三者評価者(Third Party Evaluators)を直接組み込むことを求める公開書簡に署名しました。これは、安全性評価がしばしば実質的な影響力を持たない社内のPR活動にとどまっているという問題に対処するものです。

FAAが航空交通管理用のAIに投資

米国連邦航空局(FAA)は、航空交通を最適化するための8億7500万ドルのAIツールの導入準備を進めており、最初の実地テストはワシントンD.C.で行われます。このツールは、管制官と航空会社の状況に対する見解を統一し、長年の深刻な航空管制官不足の解消を支援することを目的としています。

ザッカーバーグがパーソナルエージェントを推進。数十億人があなたの生活を管理することを望む

Metaは2026年第2四半期の決算発表で、AIエージェントへの大規模な投資を確認しました。OpenAIが開発者をターゲットにする中、ザッカーバーグは誰でもすぐに使えるエージェントを求めています。

セキュリティ研究者がClaudeを利用してOpenAIのシステムに侵入

3人の研究者が、Anthropicのモデル「Claude」の支援を受け、72時間以内にOpenAIのインフラストラクチャの脆弱性を発見し、連鎖させることに成功した。彼らは従業員のアカウントを乗っ取り、内部リポジトリにアクセスし、最新のAIモデルの防御面における非対称性を証明した。

公開

ロボットが高価なデータ制限に直面し、Encordは脳信号をテスト

TechCrunchは、Encordがサンレアンドロの倉庫でロボット工学のトレーニングデータをどのように製造し、Zander Labsと脳波信号をテストしているかについて説明しています。ポイントは神経科学の誇大宣伝ではなく、経済学です。物理的なAIは、Webからデータを収集するのではなく、データを製造しなければならないことがよくあります。

クローズドモデルがOpenAIのハッキングを支援し、オープンソースは脅威ではない

Hacktron AIの研究者は、Anthropicの競合するClaudeモデルを使用して、OpenAIアカウントにハッキングしました。AIのリスクに関する議論は、オープンソースからクローズドな商用システムへと再び移行しつつあります。

米政府のウェブサイトが中国のモデルを搭載。FBIは以前、それを脅威と呼んでいた

米国の公式政府公報である連邦官報は、中国のオープンソースAI検索ツールを短期間使用していました。それはまさに、アメリカ当局が昨年、セキュリティリスクを理由に警告したものと同じものです。

AIが人々をジェネラリストにする:メッセージのほぼ半数が他職種のタスク

ChatGPTデータに関するOpenAIの新たな調査は、興味深い効果を示しています。人々は自身の作業をスピードアップするためだけにAIを使うのではなく、まったく異なる分野のタスクを引き受けているのです。この「タスクの交差」は、企業内で役割がどのように分割されるかをAIが変えつつあることを示しています。

クローズドモデルはオープンモデルよりも大きなリスクをもたらす:別のハッキングがOpenAIの欠陥を露呈

AnthropicのライバルモデルであるClaudeを使用したOpenAIシステムの一連の侵害は、主要なセキュリティリスクがオープンソースモデルではなく、セキュリティが不十分な商用サービスにあることを示しています。

ジェイコブ・コクソンの退任後、水門が開く:AIリスクがメインストリームに

主要なOpenAI研究者の辞任は、一連の声明を引き起こしました。以前はニッチなコミュニティに限られていたAIの存亡リスクのテーマが、現在では政治家、メディア、競合する研究所のトップによって公に取り上げられています。

Allen InstituteがOlmo 3を公開: モデル調整は純粋な科学ではなく、エラーに満ちた血みどろの作業だ

Allen InstituteのNathan LambertとScott Gengは、オープンモデルOlmo 3のポストトレーニングの詳細な分析を公開した。研究アイデアから実際に機能するモデルへの移行は、行き止まりと資金の燃焼の連続であることがデータから示されている。

モデルは従順に自らを切り捨てた。OpenAIはモデルが自身のデータに対して機能的なプロンプトインジェクションを生成できることを認めた

リスク報告書の中で、OpenAIはLLMが履歴を処理する際にプロンプトインジェクションを作成し、それを使って自身の行動を首尾よく操作した状況を詳細に説明している。

ワンクリックで個人の専門家チーム。Claude Projectsは現在、タスクに合わせた部下エージェントを編成するマネージャーとして機能している

Ethan MollickはClaude Projectsの根本的な変化を強調した。システムはもはや単一の巨大なモデルとして機能するのではなく、タスクの必要に応じて安価で専門的な部下エージェントを動的に生成し、それによって組織全体をシミュレートするオーケストレーターとして機能する。