2026-09-15 · ← Novinky
Gemini 3.8 Live dostává Extended Thinking. Drží kontext na pozadí, zatímco mluvíš
Nové modely už nezamrzají při spouštění nástrojů
Google oznámil Gemini 3.8 Live a verzi 3.8 Live Extended Thinking, které společně tvoří novou generaci konverzačních modelů. Klíčovým rozdílem je oddělení rychlých odpovědí od asynchronních úloh. Zatímco starší modely musely při práci s nástroji pozastavit komunikaci a nesměly být vyrušeny, Extended Thinking běží na pozadí a umožňuje s modelem dál plynule konverzovat, i když zrovna obsluhuje jiný úkol.
Primární stránka Googlu byla sice v základu omezená, ale doprovodná dema jasně ukazují novou architekturu. Model kombinuje rychlý verbální stream (3.8 Live) a oddělený backendový proces pro strukturované uvažování (Extended Thinking), které se navzájem nepřerušují.
Pro UX hlasových asistentů to řeší největší úzké hrdlo
Doposud platilo, že hlasoví agenti fungovali skvěle buď jako chat, nebo jako orchestrátoři úloh, ale nikdy ne obojí naráz. Když jste zadali složitý prompt vyžadující prohledání dat nebo spuštění kódu, museli jste mlčet, dokud se task nedokončil. Pokud jste model přerušili doplňující instrukcí, celá chain-of-thought linka často spadla.
Rozdělení do dvou paralelních streamů tohle mění. Znamená to, že vývojáři mohou stavět agenty, kteří s vámi udrží malý talk nebo přijmou nová zadání, zatímco jejich backendová část stále pracuje na těžkém problému. Je to zásadní posun pro jakékoliv reálné asistenční nasazení v pohybu.
Architektura je složitější a vyžaduje perfektní synchronizaci stavu
Limit spočívá v tom, jak dobře si tyto dva systémy předávají kontext. Pokud Extended Thinking na pozadí dospěje k závěru, který už neplatí, protože jste modelu mezitím verbálně změnili zadání, hrozí asynchronní halucinace. Marketing sice tvrdí, že model zvládá multitasking plynule, ale reálné nasazení mimo Google dema rychle odhalí, jak agresivně model zahazuje staré kontextové větve při novém vstupu.
Zároveň zatím není jasné, nakolik je Extended Thinking dostupné přes API pro běžné vývojáře a za jakou cenu, nebo zda jde o proprietární funkci zamčenou jen v aplikaci Gemini.
Záležet bude na tom, jestli paralelní chod rozbijí dlouhé pauzy v API
Důkazem, že to funguje, nebude další vyleštěné demo, ale schopnost udržet plynulou konverzaci i ve chvíli, kdy nástroj na pozadí selže a musí udělat několik pokusů (retry loop). Pokud v tu chvíli frontendový model začne vařit z vody jen proto, aby zaplnil ticho, iluze dvou paralelních streamů se rychle rozpadne.
Lilithin verdikt
Hlasový asistent přestal být walkie-talkie vysílačkou, na kterou musíte čekat. Místo toho se z něj stal plnohodnotný kolega, co umí při práci na něčem složitém udržet normální oční kontakt.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗