2026-09-15 · ← Aktualności
Gemini 3.8 Live otrzymuje Extended Thinking. Utrzymuje kontekst w tle podczas rozmowy
Nowe modele już nie zawieszają się podczas uruchamiania narzędzi
Google ogłosiło Gemini 3.8 Live oraz wersję 3.8 Live Extended Thinking, które wspólnie tworzą nową generację modeli konwersacyjnych. Kluczową różnicą jest oddzielenie szybkich odpowiedzi od asynchronicznych zadań. Podczas gdy starsze modele musiały wstrzymywać komunikację podczas pracy z narzędziami i nie mogły być przerywane, Extended Thinking działa w tle i pozwala na płynną konwersację z modelem, nawet gdy ten obsługuje inne zadanie.
Choć główna strona Google była nieco ograniczona w szczegóły, dołączone dema jasno pokazują nową architekturę. Model łączy szybki strumień słowny (3.8 Live) z oddzielnym procesem backendowym do strukturalnego wnioskowania (Extended Thinking), które wzajemnie się nie przerywają.
Dla UX asystentów głosowych to rozwiązuje największe wąskie gardło
Do tej pory agenci głosowi działali świetnie albo jako chat, albo jako orkiestratorzy zadań, ale nigdy jako obie te rzeczy naraz. Kiedy dawałeś skomplikowany prompt wymagający przeszukania danych lub uruchomienia kodu, musiałeś milczeć, aż zadanie się skończy. Jeśli przerwałeś modelowi dodatkową instrukcją, cała ścieżka myślowa często się sypała.
Podział na dwa równoległe strumienie to zmienia. Oznacza to, że programiści mogą budować agentów, którzy potrafią podtrzymać krótką rozmowę lub przyjąć nowe instrukcje, podczas gdy ich backendowa część nadal pracuje nad ciężkim problemem. To ogromna zmiana dla każdego realnego wdrożenia asystenta w ruchu.
Architektura jest bardziej złożona i wymaga idealnej synchronizacji stanu
Ograniczenie tkwi w tym, jak dobrze te dwa systemy wymieniają się kontekstem. Jeśli Extended Thinking w tle dojdzie do wniosku, który nie jest już aktualny, ponieważ w międzyczasie werbalnie zmieniłeś polecenie, istnieje ryzyko asynchronicznych halucynacji. Marketing twierdzi, że model płynnie obsługuje wielozadaniowość, ale realne wdrożenie poza demami Google szybko ujawni, jak agresywnie model odrzuca stare gałęzie kontekstu przy nowym wejściu.
Jednocześnie nie jest jeszcze jasne, na ile Extended Thinking jest dostępne przez API dla zwykłych programistów i za jaką cenę, ani czy jest to autorska funkcja zamknięta tylko w aplikacji Gemini.
Wszystko będzie zależeć od tego, czy długie przerwy w API rozbiją równoległe działanie
Dowodem na to, że to działa, nie będzie kolejne dopracowane demo, ale zdolność do utrzymania płynnej konwersacji nawet wtedy, gdy narzędzie w tle zawiedzie i musi wykonać kilka prób ponowienia. Jeśli w tym momencie model frontendowy zacznie zmyślać tylko po to, by wypełnić ciszę, iluzja dwóch równoległych strumieni szybko się rozpadnie.
Werdykt Lilith
Asystent AI przestał być krótkofalówką, na którą musisz czekać. Zamiast tego stał się pełnoprawnym współpracownikiem, który potrafi utrzymać normalny kontakt wzrokowy podczas pracy nad czymś skomplikowanym.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗