Gemini 3.8 Flash: technický průvodce, benchmarky, API, cena a srovnání
Gemini 3.8 Flash je nejnovější model Google a v programování a agentních úlohách dosahuje úrovně velkých modelů za zlomek jejich ceny. Vyšel 2. září 2026 jako třetí model řady Flash za šest týdnů. Na DeepSWE má 73,7 %, prakticky stejně jako Claude Opus 5, ale vstupní token stojí zhruba sedminu.

Nejnovější verze Pro je přitom zatím Gemini 3.1 Pro z 19. února 2026. V článku najdete parametry, benchmarky, ceny včetně zdražení od ledna 2027, variantu Cyber a srovnání s konkurencí.
01Co je Gemini 3.8 Flash
Gemini 3.8 Flash je rychlý a levný model Google DeepMind, který Google označuje za svůj dosud nejchytřejší model řady Flash. Je stavěný na škálování AI agentů: programování, agentní úlohy a vícekrokové uvažování. Spolu s ním vyšla varianta Gemini 3.8 Flash Cyber pro kybernetickou obranu. (Google AI for Developers)
„Gemini 3.8“ je jen označení generace. Obecně dostupný model je gemini-3.8-flash; samostatný model Gemini 3.8 Pro zatím neexistuje. (Agentpedia)
Google vydává modely Flash rychle za sebou: 3.6 Flash, 3.7 Flash a 3.8 Flash během šesti týdnů. Každá verze staví na agentních schopnostech předchozí. (Agentpedia)
Nezávislé hodnocení
V aktuálním Intelligence Indexu v4.3 má Gemini 3.8 Flash při vysokém uvažování 41 bodů, o 2 více než 3.7 Flash (39); GPT-5.6 Sol na xhigh má 44. Model generuje zhruba 330 tokenů za sekundu. (Artificial Analysis, stav k 26. 9. 2026) Podle článku k vydání leží na Paretově hranici inteligence a ceny za úlohu. (Artificial Analysis)
02Rodina modelů Gemini v září 2026
Nejnovější je Gemini 3.8 Flash, nejsilnější verze Pro je ale starší Gemini 3.1 Pro, v API zatím jen jako náhled (gemini-3.1-pro-preview). Aktuální modely:
| Model | Vydáno | Zaměření |
|---|---|---|
| Gemini 3.8 Flash | 2. 9. 2026 | Rychlý agentní model, programování, dokumenty, video |
| Gemini 3.8 Flash Cyber | 2. 9. 2026 | Hledání a opravy zranitelností, jen přes program Fairwind |
| Gemini 3.5 Flash-Lite | 21. 7. 2026 | Nejlevnější úlohy ve velkém objemu |
| Gemini 3.1 Pro | 19. 2. 2026 | Nejsilnější verze Pro, v API jako náhled (Preview) |
| Gemini 3 Deep Think | 12. 2. 2026 | Hluboké uvažování na těžké problémy |
V září Google také vydal aplikaci Gemini pro Windows a představil agentní porozumění videu. (The Soo Group)
03Technické parametry Gemini 3.8 Flash
Gemini 3.8 Flash má kontextové okno 1 milion tokenů, výstup až 65 536 tokenů a explicitní režim uvažování.
| Parametr | Hodnota |
|---|---|
| Vývojář | Google DeepMind |
| ID modelu v API | gemini-3.8-flash |
| Vydání | 2. 9. 2026 (stabilní, obecná dostupnost) |
| Předchůdce | Gemini 3.7 Flash |
| Kontextové okno | 1 mil. tokenů |
| Maximální výstup | 65 536 tokenů |
| Uvažování | Explicitní režim; nastavitelná úroveň a rozpočet na přemýšlení |
| Multimodalita | Text, obrázky, audio, video a dokumenty (včetně agentního zpracování dlouhého videa) |
| Rychlost výstupu | cca 300 tokenů/s (vysoké uvažování, měření k vydání) |
| Průměrný čas na úlohu | cca 2,5 min (vysoké uvažování) |
| Cena (úvodní, do 31. 12. 2026) | 0,75 USD vstup / 3,75 USD výstup za 1 mil. tokenů |
| Cena (od 1. 1. 2027) | 1,50 USD vstup / 7,50 USD výstup za 1 mil. tokenů |
| Dostupnost | Gemini API, Google AI Studio, aplikace Gemini (předplatné Pro a Ultra) |
Úrovně uvažování
V indexu v4.3 má model při vysokém uvažování 41 bodů, při středním 40 a při nízkém 33. Úloha indexu stojí na vysoké úrovni asi 1,24 USD, na střední asi 0,93 USD. (Artificial Analysis)
Agentní porozumění videu
Místo pevného vzorkování 1 snímek za sekundu model sám rozhoduje, které části videa si prohlédne. Na benchmarku dlouhých videí LVBench to dává 87,8 % proti 87,1 % bez agentního režimu. (Agentpedia)
04Jak Gemini 3.8 Flash používat
Gemini 3.8 Flash spustíte v aplikaci Gemini, v Google AI Studio nebo přes Gemini API.
V Google AI Studio
- Otevřete Google AI Studio a přihlaste se účtem Google.
- V nastavení modelu vyberte Gemini 3.8 Flash.
- Podle úlohy nastavte úroveň uvažování a nástroje (vyhledávání, spouštění kódu).
- Hotový prompt můžete exportovat jako kód pro API.
Přes Gemini API
Ilustrační volání v Pythonu se SDK google-genai:
from google import genai
client = genai.Client() # klíč z proměnné GEMINI_API_KEY
response = client.models.generate_content(
model="gemini-3.8-flash",
contents="Najdi a oprav padající test v tomto repozitáři.",
)
print(response.text)Zdroj ukázky: Agentpedia. Úroveň uvažování, rozpočet na přemýšlení a nástroje se nastavují stejně jako u 3.7 Flash; přesné názvy parametrů ověřte v dokumentaci Gemini API.
Migrace z 3.7 Flash: stačí změnit název modelu. Nastavení agentního zpracování videa zůstává stejné. (Agentpedia)
05Benchmarky Gemini 3.8 Flash
Gemini 3.8 Flash vyhrává agentní a oborové testy (kód, terminál, finance, právo, biologie), v ovládání počítače a obecné znalostní práci ale zaostává za velkými modely. Čísla z oficiální karty Google:
| Benchmark | Co měří | Gemini 3.8 Flash | Gemini 3.7 Flash | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| DeepSWE v1.1 | Dlouhé softwarové úlohy | 73,7 % | 65,3 % | 74,0 % | 72,7 % |
| Terminal-Bench 2.1 | Práce v terminálu | 89,4 % | 85,8 % | 89,1 % | 88,8 % |
| Terminal-Bench 4.0 | Obecný agent | 19,1 % | 11,2 % | 51,8 % | 37,3 % |
| Vals Finance Agent v2 | Finanční agent | 61,4 % | 59,0 % | 58,6 % | 53,8 % |
| Harvey Legal Agent | Právní agent | 10,0 % | 8,8 % | 6,7 % | 2,5 % |
| GDPval-AA v2 (Elo) | Znalostní práce | 1545 | 1482 | 1824 | 1710 |
| HLE-Verified | Expertní uvažování | 54,9 % | 53,6 % | 54,4 % | 54,5 % |
| CharXiv Reasoning | Čtení grafů | 86,2 % | 84,5 % | 83,7 % | 85,8 % |
| LVBench | Dlouhé video | 87,8 % | 85,4 % | 75,4 % | 82,1 % |
| OSWorld 2.0 | Ovládání počítače | 59,0 % | 50,6 % | 75,4 % | 62,6 % |
| GDP.PDF | Porozumění dokumentům | 35,0 % | 34,0 % | 37,0 % | 40,0 % |
| LABBench2 | Biologický výzkum | 86,2 % | 82,1 % | 84,2 % | 82,1 % |
Nejsilnějším argumentem je efektivita: na DeepSWE dosahuje Gemini 3.8 Flash přesnosti Opus 5 za zlomek ceny na úlohu. Glean uvádí, že v dlouhých workflow nad dokumenty splnil přes trojnásobek úloh oproti 3.7 Flash. (Google DeepMind)
Srovnání s vlajkovými modely září 2026
Proti GPT-6 Astra a Claude Fable 5.1 je Gemini 3.8 Flash o třídu níž v obecné inteligenci a agentních úlohách, v dlouhých softwarových úlohách ale drží krok a je výrazně levnější.
| Benchmark | Gemini 3.8 Flash | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|---|
| AA Intelligence Index v4.3 | 41 | 53 | 53 |
| DeepSWE v1.1 | 73,7 % | 74,1 % | 67,4 % |
| Terminal-Bench 4.0 | 19,1 % | 57,9 % | 55,8 % |
| Cena API vstup / výstup (za 1 mil. tokenů) | 0,75 / 3,75 USD | 10 / 50 USD | 10 / 50 USD |
Na nezávislém žebříčku BenchLM má 3.8 Flash na CursorBench 3.2 69,2 % (Fable 5.1 73,4 %) a na OSWorld 2.0 59 % (GPT-6 Astra 72,6 %). (BenchLM) Podrobnosti o konkurentech najdete v průvodci GPT-6 Astra, průvodci Claude Fable 5.1, průvodci Grok 4.7 a průvodci Muse Spark 1.3.
06Gemini 3.8 Flash Cyber a program Fairwind
Gemini 3.8 Flash Cyber je specializovaná varianta pro hledání a automatické opravy zranitelností. Ve veřejném API není; dostanou ji jen důvěryhodní obránci přes nový program Fairwind. Přihlásit se mohou vlády a národní kybernetické úřady, provozovatelé kritické infrastruktury a klíčové technologické platformy s doloženou etickou praxí, a to formulářem. Cenu Google nezveřejnil. (Google DeepMind: Fairwind)
| Benchmark / nasazení | Výsledek Gemini 3.8 Flash Cyber | Srovnání |
|---|---|---|
| CyberGym Pass@1 (hledání zranitelností v C/C++) | 86,2 % | GPT-5.5-Cyber 85,6 %, Mythos 5 83,8 %, 3.5 Flash Cyber 77,5 % |
| CWE-Bench (opravy, pass@1) | 47,2 % | Přední frontier model 47,8 %, za výrazně vyšší cenu |
| Tým Chrome Security | 2,6× více správných oprav | Než nejlepší větší komerční modely |
| Wiz (interní penetrační test) | O 7,5 až 9,7 % vyšší záchyt | Při 2,3× až 5,2× nižší ceně |
Varianta Cyber podle dostupných zpráv našla v Chromu chybu, kterou inženýři 13 let přehlíželi. (Miraflow)
Standardní Gemini 3.8 Flash Google na CyberGym ani CWE-Bench netestoval, a proto ho nepoužívejte jako náhradu specializovaného bezpečnostního modelu. (Miraflow)
07Cena a dostupnost Gemini 3.8 Flash
Gemini 3.8 Flash stojí do konce roku 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů. Od 1. ledna 2027 se cena zdvojnásobí.
| Model | Vstup (za 1 mil. tokenů) | Výstup (za 1 mil. tokenů) |
|---|---|---|
| Gemini 3.8 Flash, úvodní cena (do 31. 12. 2026) | 0,75 USD | 3,75 USD |
| Gemini 3.8 Flash od 1. 1. 2027 | 1,50 USD | 7,50 USD |
| Claude Sonnet 5 | 2,00 USD | 10,00 USD |
| GPT-5.6 Sol | 4,00 USD | 20,00 USD |
| Claude Opus 5.5 | 4,00 USD | 20,00 USD |
| Claude Opus 5 (starší generace) | 5,00 USD | 25,00 USD |
| GPT-6 Astra / Claude Fable 5.1 | 10,00 USD | 50,00 USD |
Rozpočty plánujte podle ceny od ledna 2027, ne podle úvodní. I po zdražení je 3.8 Flash na vstupu 1,3× až 6,7× levnější než konkurenti v tabulce. Stejný harmonogram zdražení platí i pro Gemini 3.7 Flash. (Agentpedia)
Model je dostupný v Gemini API a Google AI Studio. V aplikaci Gemini, nově i ve verzi pro Windows, ho mají předplatitelé Pro a Ultra. (BenchLM, The Soo Group)
08Pro koho se Gemini 3.8 Flash vyplatí
Gemini 3.8 Flash se vyplatí všude, kde běží hodně agentních úloh a rozhoduje cena za úlohu. Na nejtěžší obecné úlohy sáhněte po větším modelu.
| Situace | Doporučení | Proč |
|---|---|---|
| Programovací agenti, opravy testů, CI | Gemini 3.8 Flash | DeepSWE na úrovni Opus 5 za zlomek ceny |
| Finance, právo, biologie | Gemini 3.8 Flash | Vede Vals Finance, Harvey Legal i LABBench2 |
| Dlouhé dokumenty a videa | Gemini 3.8 Flash | 1 mil. tokenů, agentní zpracování videa |
| Velký objem jednoduchých dotazů | Gemini 3.5 Flash-Lite | Nejlevnější varianta |
| Ovládání počítače, obecný agent | GPT-6 Astra nebo Claude Opus 5.5 | 3.8 Flash má jen 59 % na OSWorld a 19 % na Terminal-Bench 4.0 |
| Nejtěžší kód a výzkum | Claude Fable 5.1 nebo GPT-6 Astra | Vyšší obecná inteligence |
| Hluboké uvažování v ekosystému Google | Gemini 3.1 Pro nebo 3 Deep Think | Nejsilnější modely Google |
| Kybernetická obrana | Gemini 3.8 Flash Cyber (Fairwind) | Specializovaný model |
Doporučení vychází z benchmarků výše (Agentpedia). Před migrací produkce vždy otestujte model na vlastních úlohách.
09Jak psát prompty pro Gemini 3.8 Flash
Gemini 3.8 Flash je stavěný na agentní smyčky, takže mu zadávejte cíl a způsob ověření, ne jednotlivé kroky.
- Začněte na středním uvažování. Střední dá v indexu v4.3 40 bodů místo 41, úloha ale vyjde asi o čtvrtinu levněji (0,93 proti 1,24 USD); vysoké zapínejte jen tam, kde výsledek nestačí. Nízké (33 bodů) nechte na jednoduché úlohy. (Artificial Analysis)
- Definujte, kdy je hotovo. Například „všechny testy projdou, žádné nové závislosti“. Model pak iteruje, dokud podmínku nesplní.
- Využijte dlouhý kontext. Vložte celý dokument, smlouvu nebo video místo výňatků; model s 1 mil. tokenů zvládne celek.
- U videa zapněte agentní zpracování. Model si sám vybere důležité úseky místo pevného vzorkování.
- Hlídejte délku výstupu. Limit je 65 536 tokenů, dlouhé generování (celé moduly, reporty) rozdělte do více kroků.
- Měřte cenu za úlohu, ne za token. Vyšší úroveň uvažování prodlužuje úlohu; průměr na vysoké je kolem 2,5 minuty.
10Často kladené otázky o Gemini 3.8 Flash
Co je Gemini 3.8 Flash?
Rychlý a levný model Google DeepMind vydaný 2. září 2026, zaměřený na programování, agentní úlohy a vícekrokové uvažování. Google ho označuje za svůj dosud nejchytřejší model řady Flash.
Kolik stojí Gemini 3.8 Flash?
Do 31. 12. 2026 platí úvodní cena 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů. Od 1. 1. 2027 to bude 1,50 a 7,50 USD.
Jaké kontextové okno má Gemini 3.8 Flash?
1 milion tokenů na vstupu a až 65 536 tokenů na výstupu.
Existuje Gemini 3.8 Pro?
Zatím ne. Nejnovější verze Pro je Gemini 3.1 Pro z 19. února 2026, v API zatím jako náhled.
Je Gemini 3.8 Flash lepší než Claude nebo GPT?
V dlouhých softwarových úlohách (DeepSWE) dosahuje úrovně Claude Opus 5 a GPT-6 Astra za zlomek ceny. V ovládání počítače a obecné inteligenci za nimi zaostává.
Co je Gemini 3.8 Flash Cyber?
Varianta pro hledání a opravy zranitelností, dostupná jen důvěryhodným obráncům přes program Fairwind. Na CyberGym má 86,2 %.
11Verdikt: vyplatí se Gemini 3.8 Flash?
Gemini 3.8 Flash je v září 2026 nejlepší poměr výkonu a ceny pro agentní programování a práci s dlouhými dokumenty. V kódu dosahuje velkých modelů a stojí zlomek jejich ceny.
Není to ale univerzální vítěz. Na ovládání počítače a obecné agentní úlohy mají navrch GPT-6 Astra a modely Claude, a úvodní cena v lednu 2027 skončí. Pokud škálujete agenty a hlídáte náklady, začněte u 3.8 Flash; na nejtěžší úlohy mějte v záloze větší model.
Chcete AI agenty zapojit do vlastních procesů? S výběrem modelu i napojením na vaše systémy pomůžeme v rámci AI implementace.
12Zdroje
- Google DeepMind: Gemini 3.8 Flash
- Google DeepMind: karta modelu Gemini 3.8 Flash
- Google DeepMind: program Fairwind
- Google AI for Developers: modely Gemini API
- Agentpedia: kompletní průvodce Gemini 3.8 Flash
- Artificial Analysis: Gemini 3.8 Flash
- BenchLM: Gemini 3.8 Flash
- Emergent: benchmarky Gemini 3.8 Flash
- Miraflow: Gemini 3.8 Flash Cyber
- Wikipedie: Google Gemini
- Capital and Compute: modely září 2026
- The Soo Group: září 2026
- OpenAI: GPT-6 Astra
- Claude: ceník API
- Anthropic: Claude Fable 5.1