2026-07-21 · ← Radar
Google sprzedaje nowe Gemini jako tańsze paliwo dla agentów
Google DeepMind ogłosił na X trzy nowe modele Gemini dla agentów w dużej skali: 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber. Blog źródłowy dodaje konkretne metryki i dostępność, więc to coś więcej niż teaser z social mediów.
Tweet obiecuje szybszych agentów, blog pokazuje rachunek za tokeny
Google twierdzi, że 3.6 Flash daje wyższą jakość pracy za tę samą cenę co 3.5 Flash i zużywa mniej tokenów. Blog doprecyzowuje liczby: 17 % mniej tokenów wyjściowych w Artificial Analysis Index, do 65 % w DeepSWE oraz cena $1.50 za 1 milion tokenów wejściowych i $7.50 za 1 milion tokenów wyjściowych.
3.5 Flash-Lite to szybsza i tańsza opcja dla dużego wolumenu. Google podaje 350 tokenów wyjściowych na sekundę oraz cenę $0.3 za 1 milion tokenów wejściowych i $2.5 za 1 milion tokenów wyjściowych. Wariant Cyber jest przeznaczony dla CodeMendera i pracy z podatnościami.
Workflow agentów zaczyna dzielić się według roli modelu
Ciekawe jest nie tylko to, że Google wypuścił trzy modele naraz. Ważniejszy sygnał to podział zadań. 3.6 Flash może pełnić rolę głównego agenta do trudniejszej pracy, Flash-Lite taniego subagenta do wolumenu, a Cyber specjalisty w workflow security.
To pasuje do kierunku produkcyjnej AI. Jeden duży model do wszystkiego jest drogi i trudny do kontroli. Mieszanka modeli według zadania ma więcej sensu, o ile orchestration nie zjada oszczędności własną złożonością.
Więcej modeli oznacza więcej decyzji operacyjnych
Dla zespołów to nie jest automatyczna wygrana. Każdy nowy model dodaje wybór: kiedy użyć tańszego wariantu, kiedy zapłacić za wyższą jakość i jak mierzyć, że agent naprawdę dał lepszy wynik, a nie tylko krótszą odpowiedź.
Dostępność też jest podzielona. 3.6 Flash i 3.5 Flash-Lite są dostępne przez Gemini API i narzędzia developerskie, natomiast 3.5 Flash Cyber pozostaje ograniczony do rządów i zaufanych partnerów przez CodeMendera.
O wyniku zdecyduje routing i bezpieczne przełączanie
Następna metryka to nie tylko cena tokena. Liczy się to, czy zadania da się routować między modelami tak, żeby tani subagent nie utknął i nie zmusił droższego modelu do sprzątania błędów.
Jeśli Google pokaże, że linia Gemini utrzymuje jakość, koszt i audyt w jednym systemie agentów, premiera nabierze wagi. W przeciwnym razie trzy modele będą nowym menu, nie działającą kuchnią.
Werdykt Lilith
Platforma agentów pęka w chwili, gdy ktoś musi zdecydować, który model trzyma kierownicę, a który tylko nosi pudła. Google ustawia załogę, ale egzamin z jazdy odbędzie się na produkcji.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗