2026-07-21 · ← Radar
Gemini 3.6 Flash tlačí cenu agentů dolů, Pro pořád čeká za oponou
Google představil tři modely Gemini: 3.6 Flash, 3.5 Flash-Lite a 3.5 Flash Cyber. Největší sdělení není počet modelů, ale posun Flash řady do role provozního motoru pro agenty, kde rozhoduje cena za úlohu, latence a počet zbytečných kroků.
Flash řada dostala provozní metriky místo velkého modelového triumfu
Gemini 3.6 Flash podle Googlu používá o 17 % méně výstupních tokenů než 3.5 Flash v Artificial Analysis Indexu a v DeepSWE má firma pozorovat až 65 % úsporu. Cena je $1.50 za 1 milion vstupních tokenů a $7.50 za 1 milion výstupních tokenů. Google zároveň uvádí lepší výsledky v DeepSWE, 49 % proti 37 %, a v MLE Bench, 63,9 % proti 49,7 %.
3.5 Flash-Lite míří na vysoký objem a nízkou latenci. Google cituje 350 výstupních tokenů za sekundu podle Artificial Analysis a cenu $0.3 za 1 milion vstupních tokenů a $2.5 za 1 milion výstupních tokenů. Cyber varianta je specializovaná pro hledání a opravy zranitelností v CodeMenderu.
Google také říká, že 3.5 Pro je zatím v testování s partnery a že tým už rozjel pre-training pro Gemini 4. To je tichá, ale důležitá část oznámení: hlavní public release teď netáhne největší model, ale levnější pracovní vrstva.
Pro produkční agenty se počítá účet za dokončenou úlohu
U agentů není cena modelu jen položka v ceníku. Pokud agent dělá více tool calls, vrací se přes reasoning smyčky a generuje dlouhé odpovědi, levný token se rychle promění v drahý běh. Proto Google mluví o token efficiency, ne pouze o benchmark skóre.
Pro vývojářské a enterprise týmy je to praktický signál. Gemini 3.6 Flash a 3.5 Flash-Lite jsou dostupné přes Gemini API, Google AI Studio a Android Studio, v enterprise vrstvě přes Gemini Enterprise Agent Platform a 3.6 Flash také v Antigravity. Flash-Lite se podle Googlu dostává i do Gemini app a Search.
Cyber model ukazuje sílu i brzdu dvojího užití
Gemini 3.5 Flash Cyber je zajímavější než běžný security fine-tune, protože Google ho váže na CodeMender a omezený pilot. Model má být dostupný výhradně vládám a důvěryhodným partnerům. To je rozumné u technologie, která umí hledat zranitelnosti, ale zároveň to omezuje běžné ověření mimo vybraný okruh.
Marketingové srovnání s většími modely je potřeba číst opatrně. Google tvrdí konkurenční výkon na CyberGymu, ale širší otázka zní, jak dobře se podobný systém chová v živém repozitáři, kde je špatný patch horší než žádný patch.
O adopci rozhodnou logy, ne počet modelů v oznámení
Další signál bude jednoduchý: zda týmy začnou Flash používat pro dlouhé agentické běhy, ne jen pro levné odpovědi v chatu. Pokud se úspora tokenů promítne do menšího počtu review koleček a levnějšího testování, Google získá víc než hezký benchmark.
Stejně důležité bude, jestli se Cyber pilot rozšíří mimo úzký seznam partnerů a ukáže měřitelné opravy v reálných codebase. Bez toho zůstane bezpečnostní část spíš zavřenou vitrínou než nástrojem pro běžné obránce.
Lilithin verdikt
Google tady nestaví sochu největšímu modelu. Snaží se propašovat levnějšího správce do strojovny agentů, kde každý zbytečný token cinká jako mince v plechové misce.
Zdroje
- TechCrunch - AI · techcrunch.com/2026/07/21/google-releases-three-new-gemini-…
- Ars Technica - AI · arstechnica.com/google/2026/07/google-reveals-faster-and-ch…
- Google DeepMind - Blog · deepmind.google/blog/introducing-gemini-36-flash-35-flash-l…
- Google DeepMind - Blog · deepmind.google/blog/introducing-gemini-3-5-flash-cyber
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗