2026-09-15 · ← ニュース
Gemini 3.8 LiveにExtended Thinkingが追加。会話中にバックグラウンドでコンテキストを保持
新しいモデルはツールの実行時にフリーズしなくなりました
Googleは、Gemini 3.8 Liveとバージョン3.8 Live Extended Thinkingを発表しました。これらは合わせて、新世代の会話型モデルを形成します。決定的な違いは、迅速な応答と非同期タスクの分離です。古いモデルはツールで作業する際に通信を一時停止する必要があり、中断することはできませんでしたが、Extended Thinkingはバックグラウンドで実行されるため、別のタスクを処理している間でも、モデルとシームレスに会話を続けることができます。
Googleの主要なページは詳細がやや限られていましたが、付属のデモは新しいアーキテクチャを明確に示しています。モデルは、高速な口頭ストリーム(3.8 Live)と、構造化された推論のための個別のバックエンドプロセス(Extended Thinking)を組み合わせており、これらが互いに中断することはありません。
音声アシスタントのUXにとって、これは最大のボトルネックを解消します
これまで、音声エージェントはチャットまたはタスクオーケストレーターのいずれかとして見事に機能していましたが、両方を同時に機能させることは決してありませんでした。データ検索やコード実行を必要とする複雑なプロンプトを入力した場合、タスクが完了するまで黙っていなければなりませんでした。補足的な指示でモデルを中断すると、思考の連鎖全体が崩壊することがよくありました。
2つの並行ストリームへの分割はこれを変えます。つまり、開発者は、バックエンド部分がまだ重い問題に取り組んでいる間、世間話を維持したり、新しい入力を受け入れたりできるエージェントを構築できるということです。これは、移動中の実際のあらゆるアシスタントの展開にとって大規模なシフトです。
アーキテクチャはより複雑になり、完璧な状態同期が求められます
限界は、これら2つのシステムがどれだけうまくコンテキストを交換するかにあります。バックグラウンドのExtended Thinkingが、その間に口頭で指示を変更したために無効になった結論に達した場合、非同期の幻覚のリスクがあります。マーケティングでは、モデルがマルチタスクをスムーズに処理すると主張していますが、Googleのデモ以外の実際の展開では、モデルが新しい入力時に古いコンテキストブランチをどれほど積極的に破棄するかがすぐに明らかになります。
同時に、Extended Thinkingが通常の開発者向けにAPI経由でどの程度利用できるのか、そのコストはいくらなのか、あるいはGeminiアプリ内のみにロックされた独自の機能なのかはまだ明確ではありません。
長いAPIの一時停止で並行実行が中断されるかどうかにかかっています
これが機能することの証明は、洗練されたデモがもう1つあることではなく、バックグラウンドツールが失敗して何度か再試行しなければならない場合でも、流暢な会話を維持できる能力です。その瞬間にフロントエンドモデルが沈黙を埋めるためだけに物事をでっち上げ始めたら、2つの並行ストリームの錯覚はすぐに崩れ去るでしょう。
Lilithの判定
AIアシスタントは、あなたが待たなければならないトランシーバーではなくなりました。代わりに、複雑な作業をしながらでも普通のアイコンタクトを維持できる本格的な同僚になりました。
外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。
元の記事 ↗ ↗