Google、記憶とエージェントで10分間のAI動画を構成
Googleは、長尺動画を計画し、シーンの状態を追跡し、視覚的な評価からpromptを修正する4つの研究frameworkを発表した。10分間のデモ以上に重要なのは、単体の生成モデルから記憶を持つ制作システムへの移行だ。
Lilith · 厳選ニュース
AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。
Atomフィード ↗Googleは、長尺動画を計画し、シーンの状態を追跡し、視覚的な評価からpromptを修正する4つの研究frameworkを発表した。10分間のデモ以上に重要なのは、単体の生成モデルから記憶を持つ制作システムへの移行だ。
AIを学校に導入しようとする試みの多くは、孤立したパイロットプログラムに終わります。Googleはインドで、Geminiが専門のメンターとしての役割を担う政府のラボインフラを通じて、異なるルートをたどっています。
約950のClaudeエージェントが21時間にわたりDNAデータベースを探索し、CRISPR配列に似た反復構造を持つ未解明のART酵素系を見つけた。Anthropicは実験室で構成要素を確認したが、生物学的な機能はまだ分かっていない。
Microsoftの研究では、推論をロボット本体からedgeやcloudのGPUへ移すと、性能と稼働時間が向上した。一方で、数十ミリ秒のネットワーク遅延だけでも物理作業の精度が落ちるという厳しい制約も示された。
Googleは、promptによる声の作成、台詞ごとの演出、100超の言語への対応を備えたGemini 3.8 Flash TTSとFlash-Lite TTSを発表した。重要な変化は自然さだけでなく、演技を制御し再現できる点にある。
OpenAIは、スタートアップParallelの事例を公開しました。新モデルAstraは、複数ソースにまたがるリサーチを半分の時間で完了させました。エージェントワークフローを持つ企業にとって、これはトークンコストの最大50%削減を意味します。
OpenAIは、RaceTek SystemsとChip Ganassi Racingのビデオで、チームが人工知能を使用してトラックデータをより迅速な意思決定に変換する方法を紹介しています。情報源はXの短い投稿であるため、具体的な数値はなく、真の価値は証明されたパフォーマンス指標ではなく運用パターンにあります。
Microsoft ResearchとNovartisは、新薬開発における逆合成プロセスを短縮する学習ランク付けシステムであるChimeraを発表しました。
AnthropicとAccentureは、「組み込み型評価」モデルに共同で10億ドルを投資する。エンタープライズ市場において、モデルが展開される前に安全性がどう評価されるかというあり方を変える動きだ。
ChatGPTデータに関するOpenAIの新たな調査は、興味深い効果を示しています。人々は自身の作業をスピードアップするためだけにAIを使うのではなく、まったく異なる分野のタスクを引き受けているのです。この「タスクの交差」は、企業内で役割がどのように分割されるかをAIが変えつつあることを示しています。
Allen InstituteのNathan LambertとScott Gengは、オープンモデルOlmo 3のポストトレーニングの詳細な分析を公開した。研究アイデアから実際に機能するモデルへの移行は、行き止まりと資金の燃焼の連続であることがデータから示されている。
OpenAIは10万人の学術研究者にChatGPTの最上位モデルへの無料アクセスを提供します。学術界にとって、これは購買のダイナミクスを変えます。大学向けのプレムアムライセンスから、実際に引用を生み出す研究者の直接獲得へと移行します。
Basetenの研究部門はHugging FaceおよびGoodfire AIと提携しました。両社は協力して、オープンウェイトモデルの安全性を評価および監視するための不足しているインフラストラクチャを構築します。
Microsoft Researchは、推論時に生の会話履歴から一般的なスキルを抽出するEvoLibを発表しました。これにより、モデルの再トレーニングを必要とせずに、エージェントはランタイムパフォーマンスを向上させることができます。
Good Start Labsは、19世紀の鉄道シミュレーターを使用して人工知能をトレーニングしている。Latent Spaceによると、彼らは、ゲームの構成方法によって、エージェントがそのスキルを現実世界のビジネスリサーチに適用できるかどうかが決まることを発見した。
Google Researchは、クエリ実行中の高価な自己回帰推論なしでエキスパートレベルのAI検索結果を達成するRetrieve-for-Trainフレームワークを導入しました。代わりに、強化学習(RL)を使用して軽量な拡散モデルを事前にトレーニングします。
Googleは、高速な会話とツールを使用した長時間の思考を分離する新しいExtended Thinking機能を備えたGemini 3.8 Liveをリリースしました。音声AIユーザーにとって、これは実行中のプロセスに割り込んで話しかけた際にタスクが中断する問題の終焉を意味します。
Genzai no ejento wa maruchisuteppu no purosesu de shippaisuru. Shiztekina benchmarku no kawarini, Microsoft Research wa tasuku no fukuzatsusa to tomoni dotekini shinkasuru shimyureshon de karera o kunrenshite iru.
OpenAIは、彼らのモデルが初めてミレニアム懸賞問題の1つ(ナビエ・ストークス方程式)を解決したと発表しました。しかし、この成果は、誰がそのブレークスルーを実際に所有し、どのように生み出されたかについての論争に直ちに埋もれてしまいました。
Anthropicは、生物兵器の開発に関連する研究のために自社のモデルを使用しようとした科学者による複数の試みを検出し、ブロックしたと発表しました。アクセスを遮断したことは、AIを活用したバイオテロの脅威が理論の領域から抜け出しつつあることを裏付けています。