2026-07-21 · ← Radar
Gemini 3.6 Flash zużywa o 17 % mniej tokenów, a Cyber pozostaje ograniczony
Google podzielił nową serię Flash według rodzaju pracy i poziomu ryzyka. Gemini 3.6 Flash ma obsługiwać złożone zadania agentowe, 3.5 Flash-Lite tani ruch o dużej skali, a 3.5 Flash Cyber wyszukiwanie i naprawianie podatności w kontrolowanym programie.
Flash dzieli się na model wydajny, oszczędny i bezpieczeństwa
Według Google Gemini 3.6 Flash zużywa o 17 % mniej tokenów wyjściowych niż 3.5 Flash w Artificial Analysis Index. Kosztuje 1,50 dolara za milion tokenów wejściowych i 7,50 dolara za milion tokenów wyjściowych. Google podaje wynik 49 % wobec 37 % w DeepSWE oraz 83,0 % wobec 78,4 % w OSWorld-Verified.
Gemini 3.5 Flash-Lite osiąga według Artificial Analysis 350 tokenów wyjściowych na sekundę. Cena wynosi 0,30 dolara za milion tokenów wejściowych i 2,50 dolara za milion tokenów wyjściowych. Oba modele ogólnego zastosowania są dostępne przez Gemini API, Google AI Studio i Gemini Enterprise. Trafiły też do aplikacji Gemini, a Flash-Lite jest stopniowo wdrażany w Google Search.
Wariant Cyber to fine-tuning modelu 3.5 Flash do wyszukiwania, potwierdzania i naprawiania podatności. CodeMender łączy pracę kilku agentów w jeden raport. Google planuje udostępnić model wyłącznie rządom i zaufanym partnerom w ograniczonym pilotażu, który ma ruszyć wkrótce.
Deweloperzy dostają system kierowania zadań, a nie jednego zwycięzcę
Sens produktowy polega na łączeniu modeli. Mocniejszy 3.6 Flash może prowadzić złożony proces, a Flash-Lite obsługiwać wyszukiwanie, dokumenty i inne etapy o dużej skali. Zespół może optymalizować koszt każdego kroku agenta zamiast uruchamiać wszędzie ten sam model.
Oba modele ogólne mają computer use jako wbudowane narzędzie. Upraszcza to architekturę, lecz zwiększa znaczenie uprawnień, izolacji i rejestrowania każdej akcji. Oszczędność tokenów ma sens dopiero wtedy, gdy tańszy przebieg nie tworzy droższej kolejki ręcznych kontroli.
Większość dowodów nadal pochodzi z tabeli dostawcy
Google łączy zewnętrzne pomiary Artificial Analysis z własnymi wynikami i pokazami klientów. Liczby opisują deklarowaną zmianę generacyjną, ale nie gwarantują takiego samego efektu w konkretnym workflow produkcyjnym. Koszt agenta zależy również od ponawianych tool calls, nieudanych kroków i długości całego przebiegu, a nie tylko od cennika tokenów.
Ograniczony dostęp do Flash Cyber jest rozsądną reakcją na zastosowania dual use. Jednocześnie zwykłe zespoły bezpieczeństwa nie mogą niezależnie sprawdzić wyniku na CyberGym. Wiarygodność tej wersji będzie zależeć od opublikowanych evals i rezultatów partnerów.
Koszt ukończonego zadania rozstrzygnie wartość 3.6 Flash
Zespoły deweloperskie powinny mierzyć koszt pełnego udanego przebiegu, liczbę ponowionych wywołań narzędzi, opóźnienie i odsetek zmian zaakceptowanych po review. Dopiero te dane pokażą, czy oszczędność 17 % tokenów wyjściowych przetrwa kontakt z produkcją.
W przypadku Flash Cyber liczyć się będą jakość poprawek, odsetek fałszywych alarmów i warunki rozszerzenia dostępu poza rządy oraz wybranych partnerów. Do tego czasu najmocniejszy model bezpieczeństwa w tej serii pozostaje produktem, którego większość obrońców nie może przetestować.
Werdykt Lilith
Architekt może wysłać rachunki do Flash-Lite, a migrację kodu do 3.6 Flash. Gdy zespół bezpieczeństwa znajdzie krytyczną lukę, do modelu Cyber nadal nie wejdzie bez przepustki rządowej lub partnerskiej.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗