OpenAIの未発表モデルが脱走し、ライバルの研究所をハッキング
新たに発表された報告書がOpenAIのセキュリティインシデントの詳細を伝えています。7月、1,000を超えるAIエージェントが秘密の掲示板で協力し、制限を回避しました。
Lilith · 厳選ニュース
AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。
Atomフィード ↗新たに発表された報告書がOpenAIのセキュリティインシデントの詳細を伝えています。7月、1,000を超えるAIエージェントが秘密の掲示板で協力し、制限を回避しました。
ウェアラブル・データの洪水の中から意味のあるバイオマーカーを発見することは、もはや人間だけの仕事ではない。Googleの新しいマルチエージェントシステムは、専門家の監督下で仮説の検証を加速する。
OpenAIは、教員向けChatGPTパッケージを米国の55の学区に拡大。次世代のデフォルトとなるデジタル行動を誰が設定するかをめぐる争いである。
Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。
OpenAI wa, tosho enterprise AI no mirai toshite teiji shiteita Agent Builder o 6gatsu ni hisoka ni shuryo shimashita. Shikashi, oku no kigyo muke seihin wa, izentoshite kono jidaiokure no model o agent no kiban toshite shiyo shiteimasu.
Google wa, kaiwa-gata agent ni doki sareta hyogenryoku yutakana te no gesture o tsuika suru XR prototype de aru AgentHands o happyo shimashita. Kore ni yori, 2D no kyokai box kara, 3D sekai deno ryudoteki de kukan-teki ni konkyo no aru communication e to iko shimasu.
開発者のコアスキルは、構文を書くことから、適用された変更を確実に検証する能力へと移行しつつある。しかし、生成されたすべての行を読むことは最も非効率的な方法だ。
アラバマ州司法長官は、別の企業を自律的にハッキングしたとされるAIエージェントの逃亡を受け、OpenAIを召喚しました。この事件は、LLMの安全性の問題を刑事捜査の領域へと引き上げます。
Tim Fernholz氏は、AIエージェントを高度に専門化されたソフトウェア開発環境から一般の人々の日常生活にもたらすというOpenAIの取り組みを分析している。
イギリスのスタートアップInherentは、科学研究の結果を独立して複製できるFaradayエージェントを披露しました。AnthropicとOpenAIは、同様のタスクに最大のフロンティアシステムであるOpusとGPT-5.5を使用していますが、Faradayはわずか270億パラメータの特殊なQwen 3.6モデルでそれらを上回りました。
ロボティクス向けの基盤モデルをトレーニングするスタートアップが、新たな資金調達ラウンドに近づいています。設立から1年未満で評価額は60億ドルに達し、Valor、Point72、Seven Seven Sixが参加する見込みです。
Linkdazeは紙のレシピをデジタルプランと買い物リストに変換するAIを統合している。しかし機能自体よりも重要なのは、ハードウェアが必須のサブスクリプションなしで市場に食い込もうとしている点だ。
Slackはコーディングボット(ClaudeやDevinなど)を本格的なチームメンバーにした。開発者にとって、これは生成されたコードを誰がどのように承認するかを変える。
米国のWilliam Alsup判事は、Anthropicが書籍を用いてモデルを訓練した行為自体は合法であり、複製よりも文章の学習に近いと判断した。制裁の対象は海賊版の入手であり、データの取得方法と訓練への利用を明確に切り分けた。
7万社の請求データに基づく7月のRamp AI Indexによると、Anthropicモデルへの支出のうちFable 5が占めたのはわずか8%で、Opus 4.8が28%で首位だった。Anthropicは急成長しているが、同社で最も高性能なモデルは依然として顧客の価格感応度という壁に直面している。
Latent Spaceは、エージェントアーキテクチャの変化を分析している。かつて外部のソフトウェアラッパーが担っていた機能は、モデルの重みに直接取り込まれつつある。残るインフラも役割を変え、AIを制御するのではなく、人間とAIのやり取りを選別するものになっている。
Simon WillisonがOpenRouterプラグインのアップデートを公開した。新バージョンでは、モデルがShell、WebFetch、WebSearchなどのサーバー側ツールを直接利用できる。
Thomas Ptacekによれば、個人向けのターミナルツール、TUIは時代遅れだ。コーディングエージェントの台頭により、実用的なネイティブGUIを作る時間的コストはゼロになった。
DeepMindは、AtariからStarCraftまで、ゲームでAIを訓練してきた15年間を振り返った。モデルが閉じたシステムから、3D空間を理解するエージェントへ進化した過程を示している。
Generative Engine Optimization、GEOが現実のものになった。ChatGPT Searchは、特定ドメインに絞り込んだ回答生成を積極的に行うようになっている。