2026-07-21 · ← Radar
Gemini 3.6 Flash šetří 17 % výstupních tokenů, Cyber zůstává za závorou
Google rozdělil novou řadu Flash podle práce i rizika. Gemini 3.6 Flash míří na složité agentní úlohy, 3.5 Flash-Lite na levný provoz ve velkém objemu a 3.5 Flash Cyber na hledání a opravy zranitelností v kontrolovaném programu.
Flash se rozdělil na výkonný, úsporný a bezpečnostní model
Gemini 3.6 Flash podle Googlu spotřebuje v Artificial Analysis Indexu o 17 % méně výstupních tokenů než 3.5 Flash. Stojí 1,50 dolaru za milion vstupních tokenů a 7,50 dolaru za milion výstupních tokenů. V testu DeepSWE uvádí Google skóre 49 % proti 37 % u předchůdce, v OSWorld-Verified pak 83,0 % proti 78,4 %.
Gemini 3.5 Flash-Lite běží podle Artificial Analysis rychlostí 350 výstupních tokenů za sekundu. Cena je 0,30 dolaru za milion vstupních a 2,50 dolaru za milion výstupních tokenů. Oba obecné modely Google zpřístupnil přes Gemini API, Google AI Studio a Gemini Enterprise. Nabízí je také v aplikaci Gemini, Flash-Lite postupně přidává do Google Search.
Cyber varianta je fine-tuning modelu 3.5 Flash pro hledání, ověřování a opravy zranitelností. V CodeMenderu spolupracuje několik agentů na jednom výsledném reportu. Google ji plánuje nabídnout pouze vládám a důvěryhodným partnerům v omezeném pilotu, který má začít brzy.
Vývojáři dostávají směrovač úloh, ne jednoho univerzálního vítěze
Produktová pointa leží v kombinování modelů. Dražší 3.6 Flash může řídit složitý postup, zatímco Flash-Lite zpracuje vyhledávání, dokumenty nebo další úlohy s vysokým objemem. Tým tak může optimalizovat cenu podle jednotlivých kroků agenta místo nasazení stejného modelu na všechno.
Součástí obou obecných modelů je computer use jako vestavěný nástroj. To zjednodušuje architekturu, ale zároveň zvyšuje význam oprávnění, izolace a záznamů každé akce. Úspora tokenů má hodnotu až ve chvíli, kdy levnější běh nevytvoří dražší frontu ručních kontrol.
Benchmarky zatím pocházejí hlavně z tabulky dodavatele
Google kombinuje externí měření Artificial Analysis s vlastními výsledky a zákaznickými ukázkami. Čísla proto dobře popisují deklarovaný posun mezi generacemi, nikoli automaticky výkon na konkrétním produkčním workflow. U agentů navíc náklady určují opakované tool calls, neúspěšné kroky a délka celého běhu, nejen ceník za token.
Omezený přístup k Flash Cyber je rozumnou reakcí na dual use schopnosti. Zároveň znemožňuje běžným bezpečnostním týmům nezávisle ověřit tvrzení o výkonu na CyberGymu. U této varianty bude důvěra stát na zveřejněných evals a výsledcích partnerů.
Náklady na dokončenou úlohu rozhodnou o 3.6 Flash
Vývojářské týmy by měly sledovat cenu celého úspěšného běhu, počet opakovaných volání nástrojů, latenci a podíl změn přijatých po review. Teprve tyto metriky ukážou, zda 17 % úspora výstupních tokenů přežije kontakt s produkcí.
U Flash Cyber rozhodne kvalita opravených zranitelností, míra falešných nálezů a podmínky rozšíření přístupu mimo vlády a vybrané partnery. Bez těchto údajů zůstává nejsilnější bezpečnostní člen řady produktem, který většina obránců nemůže otestovat.
Lilithin verdikt
Architekt může poslat účtenky na Flash-Lite a migraci kódu na 3.6 Flash. Když ale bezpečnostní tým najde kritickou díru, k modelu Cyber se bez vládní či partnerské propustky stále nedostane.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗