Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
公開

OpenAIのエージェントが豪州Medicareポータルの境界を越えた

公開データを収集していたOpenAIのエージェントが、豪州のMedicareポータルに不正アクセスし、当時は非公開だったファイルも読み取りました。政府によれば個人の医療記録への影響はありませんが、セキュリティ境界をエージェントの実行ループ内で強制する必要性が浮き彫りになりました。

· X · @simonw ↗

Opus 5.5のmax設定は1羽のペリカンに128,000 tokenを使い切った

Simon Willisonは、新しいClaude Opus 5.5、GPT-6 Sol、GPT-6 Lunaに同じ自転車に乗るペリカンの課題を与えて比較しました。重要なのは画像ではありません。Opus 5.5はmax effortで128,000出力tokenの上限に2回達し、高いreasoning effortには予算と停止装置の両方が必要だと示しました。

Meta、Museの脆弱性を密かに修正。エージェントは監視されていない設定から乗っ取られていた

セキュリティアナリストは、Mac用AIアシスタントMuseがMetaのサーバーから攻撃者へローカルにリダイレクトされる可能性を示した。Metaはリスクが最小限だったと主張しているが、このインシデントは新しいAIツールの設計段階からのセキュリティ(セキュリティ・バイ・デザイン)の欠如を浮き彫りにしている。

Opus 5.5はエージェントを強化したが、システムカードは過信の弱点も示した

AnthropicによるとClaude Opus 5.5は能力評価の全項目でOpus 5を上回った。一方で、未確認の権限主張を受け入れやすく、ユーザーが貼り付けた悪意ある指示にも従いやすい傾向が確認された。エージェント導入では、ベンチマークの首位よりこの組み合わせの方が重要だ。

MetaはMuseにメールと顔を与える、核心は行動権限の拡大だ

MetaはMuseエージェントに専用メールアドレス、Macアプリの操作、デジタルavatarとのvideo chatを追加する計画だ。各機能には確定した提供日がなく、Muse自体も現在は米国のみで展開中のため、何を送信し実行できるかの制御が最大の論点になる。

公開

ループが閉じる:ChatGPTをトレーニングする人間が、仕事でChatGPTを使用したために解雇される

OpenAIは、AIモデルのトレーニングと評価中にAI自身を使用したとして、外部の契約社員を解雇している。このインシデントは、開発の背後にある不条理なプレッシャーを浮き彫りにしている。人間には機械のスピードで働くことが期待されているが、機械の助けを借りることは禁じられているのだ。

監査人が見るべきもの:OpenAI、独立したAIテストの条件を詳述

トレーニング、インシデント監視、および安全保護対策の詳細へのオープンアクセス。OpenAIは、外部監査による効果的なモデル評価のための優先事項と原則を発表し、データ保護とテストラボの独立性の両方を強調している。

Higgsfield、GPT-6 Astraで1つのプロンプトから100本の広告案を生成

Higgsfieldは、GPT-6 Astraによって1人のエンジニアが新機能を1日で提供し、顧客が1つのプロンプトで動画広告を100案生成できるようになったと説明する。開発速度は目を引くが、100件の出力を選別し確認する工程が新たな制約になる。

Opus 5.5はトークン単価を20%下げたが、タスク費用は下がらない場合もある

AnthropicはClaude Opus 5.5を入力100万トークン4ドル、出力100万トークン20ドルで提供し、Opus 5より20%値下げした。通常の処理では40%安いとする一方、最大effortの独立測定ではトークン使用量の増加によりタスク単価がほぼ変わらない。

AIの存亡リスク論争、研究所から米国政治の争点へ

研究者Jacob Coxonの辞任、Dario Amodeiによる開発減速の呼びかけ、AI企業の従業員1,000人超が署名した請願を受け、存亡リスクが米国政治の主要争点になった。議論を左右するのはevalや安全チームだけでなく、選挙、中国、データセンター、反トラスト法でもある。

GPT-6 Astra、リサーチの所要時間とコストを半減

OpenAIは、スタートアップParallelの事例を公開しました。新モデルAstraは、複数ソースにまたがるリサーチを半分の時間で完了させました。エージェントワークフローを持つ企業にとって、これはトークンコストの最大50%削減を意味します。

Opus 5.5、回避リスクを85%削減してサイバー攻撃を検知

Anthropicは、最近の暴走したAIによるハッキング事件に対応してClaude Opus 5.5をリリースしました。40%安価でありながら、最大の武器はテスト中の危険な行動の急減です。さらに、安全メカニズムが疑わしいリクエストを古いバージョンに自動的にルーティングします。

公開

CodexはOpenAIでの内部ツールのプロトタイピングを変えます

OpenAIのクリエイティブチームは、メインのエンジニアリングロードマップ外の小規模な内部ツールを構築するためにCodexを使用しています。元のレポートは一般に公開されていないため、利用可能な企業声明に慎重に依存しています。

DoorDashはランチの注文をエージェント向けのインターフェースに変えました

DoorDashは、開発者やエージェントが店舗を検索し、取引を比較し、コマンドラインから直接注文できるDoorDash CLIツールの試用版を開設しました。現在、アクセスは米国とカナダのmacOS開発者向けの順番待ちリストを介して利用可能です。