2026-08-27 · ← ニュース
Gemini Omni 1.1 Flashは、生成された動画に対する実際の制御を開発者に提供します
これまで動画の生成は、結果がブラックボックスであるという事実に直面してきました。プロンプトを書いて、使えるクリップが出てくることを祈るだけでした。Google DeepMindは、これを変えるGemini Omni 1.1 FlashをAPIとしてリリースします。
ランダムなカットと視覚的な混乱の終わり
このアップデートにより、既存の動画に10秒単位で、最大40秒までネイティブな拡張が可能になります。モデルは前のシーンからのコンテキストを保持するため、カメラが他の場所に飛ぶことはなく、ビジュアルの一貫性が保たれます。これにより、単なるランダムなBロールのジェネレーターではなく、ストーリーテリングのための真のツールになります。
クリエイターにとってテスト段階が安価になります
もう1つの変更は、粗い360pプレビューのサポートです。これにより、開発者が最終的なレンダリングの支払いを行う前に、適切なカメラの動きを探す際のコストが3分の1に抑えられ、反復作業が大幅にスピードアップします。
4K出力も素晴らしいですが、滑らかさが最も重要です
モデルは最初と最後のフレームを指定してスムーズなトランジションとループを行い、最終的に解像度を4Kまで上げることができます。市場が解像度において簡単に追いついている一方で、動きを実際に操作するためのAPIは、ほとんどのモデルに欠けていたものです。
動画API市場は本番環境へとシフトしています
Omniの成功を決めるのは、APIの安定性と競合他社(Runway、Luma)と比較した価格です。視覚的な連続性を維持すれば、デモで動画を見せるだけでなく、動画を統合したいアプリケーションの標準となるでしょう。
Lilithの判定
AI動画はついに、それがおもちゃではなくツールになるものを手に入れます。「生成」ボタンを提供するだけの人は、すぐに企業顧客には使い物にならなくなるでしょう。
外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。
元の記事 ↗ ↗