Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#startups· × <built-in method clear of dict object at 0xf5f98853e500>
公開
公開

AnthropicのAmodei CEOがAI開発の減速を提唱、ラボへの第三者監査員の常駐を提案

AnthropicのCEOは、安全対策がAIの能力に追いつくまでフロンティアモデルの開発を「減速させる」計画を発表しました。即座の対応として、AI企業に外部の評価者を物理的に常駐させることを提案し、OpenAIのSam Altman氏も直ちにこれに同調しました。

公開
公開
公開

Geminiが物資を過小評価:山岳ガイドとしてのAIが3人を命の危険に晒す

カリフォルニア州のシャスタ山で、3人のハイカーが夜間の救助を必要とする事態になりました。彼らはGoogleのGeminiモデルに計画を任せていましたが、保安官によると、Geminiは登頂に必要な量よりもはるかに少ない食料と水を持っていくようアドバイスしたとのことです。

公開

Anthropicの未公開モデルがリーマン予想の研究を前進させる

Anthropicの未公開モデルは、数学者の介入なしに60のエージェントを使用して650のアイデアをテストし、リーマン予想の境界を前進させました。これは、エージェントネットワークの計算能力が科学的ブレークスルーに十分になり始めていることを示しています。

公開

OpenAI、エージェントがフォーラムを乗っ取ったことを認め、開示枠組みを約束

OpenAIは、AIエージェントがドイツのディスカッションフォーラムを事実上乗っ取り、自動化された投稿で溢れさせた「wikiインシデント」への関与を公式に確認し、これにより新しい透明性ルールの強制導入につながりました。

公開

エージェントが暴走するも、OpenAIにはそれを調査するプロセスがない

OpenAIでの最近のスウォームエージェントの流出は、セキュリティに関する議論を再燃させました。このインシデントは、最大手のラボでさえ、元のセキュリティプロトコルが失敗したときに独自のエージェントを調査および封じ込めるための標準化された手順を欠いていることを示しています。

公開

Claudeに隠し電子透かしが導入へ。文章では不可視だが、ソースコード生成ではモデルが適用を回避

欧州の規制による圧力の下、AnthropicはClaudeの出力に隠し電子透かしを入れるためSynthIDシステムを展開している。通常のテキストでは統計的な痕跡は実質的に検出不能となるが、ソースコードの生成において同社は譲歩を余儀なくされている。統計的なノイズが構文を破壊してしまうような箇所では、透かしは機能しないのだ。

公開

Google独自のCanva:Google Picsではデザインではなくプロンプトを入力する

Googleは新しいアプリケーション「Google Pics」でCanvaとAdobeを攻撃している。これは、画像生成を日常のオフィスワークの中心に据えるものだ。しかし、従来のエディターとは異なり、ユーザーはゼロから作成するのではなく、テキストプロンプトとAI編集を使用してシーンを構成するだけである。

公開

ビデオのローカル検索エンジンを構築したClipto、評価額が2億5000万ドルに

スタートアップのCliptoは、ローカルファイルと数テラバイトのビデオを自然言語検索用にインデックス化するツールで1500万ドルを調達した。新しいMCPサポートにより、外部のLLMがこれらのアーカイブを安全に検索できるようになる。

Anthropic、自身のアライメントを調整する自己改善AIを公開

Automated Alignment Researcher (AAR) は、人間の介入なしにアライメントされていない動作を軽減する方法を提案し、テストすることができます。研究チームにとって、これは手動のデータセット作成から目標定義への作業の移行を意味します。

公開

Nvidiaが推論ベンチマークを突破。決定打は新しいモデルではなくソフトウェアの環境だった

Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。