Přeskočit na obsah
Umělá inteligence

Gemini 3.8 Flash: technický průvodce, benchmarky, API, cena a srovnání

Gemini 3.8 Flash je nejnovější model Google a v programování a agentních úlohách dosahuje úrovně velkých modelů za zlomek jejich ceny. Vyšel 2. září 2026 jako třetí model řady Flash za šest týdnů. Na DeepSWE má 73,7 %, prakticky stejně jako Claude Opus 5, ale vstupní token stojí zhruba sedminu.

Obálka článku Gemini 3.8 Flash: kontext 1 milion tokenů, 73,7 % v testu DeepSWE v1.1 a cena 0,75 a 3,75 USD za milion tokenů

Nejnovější verze Pro je přitom zatím Gemini 3.1 Pro z 19. února 2026. V článku najdete parametry, benchmarky, ceny včetně zdražení od ledna 2027, variantu Cyber a srovnání s konkurencí.

01Co je Gemini 3.8 Flash

Gemini 3.8 Flash je rychlý a levný model Google DeepMind, který Google označuje za svůj dosud nejchytřejší model řady Flash. Je stavěný na škálování AI agentů: programování, agentní úlohy a vícekrokové uvažování. Spolu s ním vyšla varianta Gemini 3.8 Flash Cyber pro kybernetickou obranu. (Google AI for Developers)

„Gemini 3.8“ je jen označení generace. Obecně dostupný model je gemini-3.8-flash; samostatný model Gemini 3.8 Pro zatím neexistuje. (Agentpedia)

Google vydává modely Flash rychle za sebou: 3.6 Flash, 3.7 Flash a 3.8 Flash během šesti týdnů. Každá verze staví na agentních schopnostech předchozí. (Agentpedia)

Nezávislé hodnocení

V aktuálním Intelligence Indexu v4.3 má Gemini 3.8 Flash při vysokém uvažování 41 bodů, o 2 více než 3.7 Flash (39); GPT-5.6 Sol na xhigh má 44. Model generuje zhruba 330 tokenů za sekundu. (Artificial Analysis, stav k 26. 9. 2026) Podle článku k vydání leží na Paretově hranici inteligence a ceny za úlohu. (Artificial Analysis)

02Rodina modelů Gemini v září 2026

Nejnovější je Gemini 3.8 Flash, nejsilnější verze Pro je ale starší Gemini 3.1 Pro, v API zatím jen jako náhled (gemini-3.1-pro-preview). Aktuální modely:

ModelVydánoZaměření
Gemini 3.8 Flash2. 9. 2026Rychlý agentní model, programování, dokumenty, video
Gemini 3.8 Flash Cyber2. 9. 2026Hledání a opravy zranitelností, jen přes program Fairwind
Gemini 3.5 Flash-Lite21. 7. 2026Nejlevnější úlohy ve velkém objemu
Gemini 3.1 Pro19. 2. 2026Nejsilnější verze Pro, v API jako náhled (Preview)
Gemini 3 Deep Think12. 2. 2026Hluboké uvažování na těžké problémy
Zdroje: Wikipedie: Google Gemini, Capital and Compute, Google AI for Developers

V září Google také vydal aplikaci Gemini pro Windows a představil agentní porozumění videu. (The Soo Group)

03Technické parametry Gemini 3.8 Flash

Gemini 3.8 Flash má kontextové okno 1 milion tokenů, výstup až 65 536 tokenů a explicitní režim uvažování.

ParametrHodnota
VývojářGoogle DeepMind
ID modelu v APIgemini-3.8-flash
Vydání2. 9. 2026 (stabilní, obecná dostupnost)
PředchůdceGemini 3.7 Flash
Kontextové okno1 mil. tokenů
Maximální výstup65 536 tokenů
UvažováníExplicitní režim; nastavitelná úroveň a rozpočet na přemýšlení
MultimodalitaText, obrázky, audio, video a dokumenty (včetně agentního zpracování dlouhého videa)
Rychlost výstupucca 300 tokenů/s (vysoké uvažování, měření k vydání)
Průměrný čas na úlohucca 2,5 min (vysoké uvažování)
Cena (úvodní, do 31. 12. 2026)0,75 USD vstup / 3,75 USD výstup za 1 mil. tokenů
Cena (od 1. 1. 2027)1,50 USD vstup / 7,50 USD výstup za 1 mil. tokenů
DostupnostGemini API, Google AI Studio, aplikace Gemini (předplatné Pro a Ultra)
Zdroje: Agentpedia, BenchLM, Artificial Analysis, Google DeepMind: karta modelu

Úrovně uvažování

V indexu v4.3 má model při vysokém uvažování 41 bodů, při středním 40 a při nízkém 33. Úloha indexu stojí na vysoké úrovni asi 1,24 USD, na střední asi 0,93 USD. (Artificial Analysis)

Agentní porozumění videu

Místo pevného vzorkování 1 snímek za sekundu model sám rozhoduje, které části videa si prohlédne. Na benchmarku dlouhých videí LVBench to dává 87,8 % proti 87,1 % bez agentního režimu. (Agentpedia)

04Jak Gemini 3.8 Flash používat

Gemini 3.8 Flash spustíte v aplikaci Gemini, v Google AI Studio nebo přes Gemini API.

V Google AI Studio

  1. Otevřete Google AI Studio a přihlaste se účtem Google.
  2. V nastavení modelu vyberte Gemini 3.8 Flash.
  3. Podle úlohy nastavte úroveň uvažování a nástroje (vyhledávání, spouštění kódu).
  4. Hotový prompt můžete exportovat jako kód pro API.

Přes Gemini API

Ilustrační volání v Pythonu se SDK google-genai:

python
from google import genai

client = genai.Client()  # klíč z proměnné GEMINI_API_KEY

response = client.models.generate_content(
    model="gemini-3.8-flash",
    contents="Najdi a oprav padající test v tomto repozitáři.",
)

print(response.text)

Zdroj ukázky: Agentpedia. Úroveň uvažování, rozpočet na přemýšlení a nástroje se nastavují stejně jako u 3.7 Flash; přesné názvy parametrů ověřte v dokumentaci Gemini API.

Migrace z 3.7 Flash: stačí změnit název modelu. Nastavení agentního zpracování videa zůstává stejné. (Agentpedia)

05Benchmarky Gemini 3.8 Flash

Gemini 3.8 Flash vyhrává agentní a oborové testy (kód, terminál, finance, právo, biologie), v ovládání počítače a obecné znalostní práci ale zaostává za velkými modely. Čísla z oficiální karty Google:

BenchmarkCo měříGemini 3.8 FlashGemini 3.7 FlashClaude Opus 5GPT-5.6 Sol
DeepSWE v1.1Dlouhé softwarové úlohy73,7 %65,3 %74,0 %72,7 %
Terminal-Bench 2.1Práce v terminálu89,4 %85,8 %89,1 %88,8 %
Terminal-Bench 4.0Obecný agent19,1 %11,2 %51,8 %37,3 %
Vals Finance Agent v2Finanční agent61,4 %59,0 %58,6 %53,8 %
Harvey Legal AgentPrávní agent10,0 %8,8 %6,7 %2,5 %
GDPval-AA v2 (Elo)Znalostní práce1545148218241710
HLE-VerifiedExpertní uvažování54,9 %53,6 %54,4 %54,5 %
CharXiv ReasoningČtení grafů86,2 %84,5 %83,7 %85,8 %
LVBenchDlouhé video87,8 %85,4 %75,4 %82,1 %
OSWorld 2.0Ovládání počítače59,0 %50,6 %75,4 %62,6 %
GDP.PDFPorozumění dokumentům35,0 %34,0 %37,0 %40,0 %
LABBench2Biologický výzkum86,2 %82,1 %84,2 %82,1 %
Zdroj: oficiální karta Google podle Agentpedia. Všechna čísla uvádí výrobce, konfigurace konkurence zvolil Google. Claude Opus 5 od 22. 9. 2026 nahradil Claude Opus 5.5, v kartě Google zatím není.

Nejsilnějším argumentem je efektivita: na DeepSWE dosahuje Gemini 3.8 Flash přesnosti Opus 5 za zlomek ceny na úlohu. Glean uvádí, že v dlouhých workflow nad dokumenty splnil přes trojnásobek úloh oproti 3.7 Flash. (Google DeepMind)

Srovnání s vlajkovými modely září 2026

Proti GPT-6 Astra a Claude Fable 5.1 je Gemini 3.8 Flash o třídu níž v obecné inteligenci a agentních úlohách, v dlouhých softwarových úlohách ale drží krok a je výrazně levnější.

BenchmarkGemini 3.8 FlashGPT-6 AstraClaude Fable 5.1
AA Intelligence Index v4.3415353
DeepSWE v1.173,7 %74,1 %67,4 %
Terminal-Bench 4.019,1 %57,9 %55,8 %
Cena API vstup / výstup (za 1 mil. tokenů)0,75 / 3,75 USD10 / 50 USD10 / 50 USD
Gemini 3.8 Flash: karta Google podle Agentpedia. Index: Artificial Analysis, stav k 26. 9. 2026. GPT-6 Astra a Claude Fable 5.1: srovnávací tabulka OpenAI (viz průvodce GPT-6 Astra), Fable 5.1 na Terminal-Bench 4.0 podle Anthropic. Čísla pocházejí z různých měření, berte je orientačně.

Na nezávislém žebříčku BenchLM má 3.8 Flash na CursorBench 3.2 69,2 % (Fable 5.1 73,4 %) a na OSWorld 2.0 59 % (GPT-6 Astra 72,6 %). (BenchLM) Podrobnosti o konkurentech najdete v průvodci GPT-6 Astra, průvodci Claude Fable 5.1, průvodci Grok 4.7 a průvodci Muse Spark 1.3.

06Gemini 3.8 Flash Cyber a program Fairwind

Gemini 3.8 Flash Cyber je specializovaná varianta pro hledání a automatické opravy zranitelností. Ve veřejném API není; dostanou ji jen důvěryhodní obránci přes nový program Fairwind. Přihlásit se mohou vlády a národní kybernetické úřady, provozovatelé kritické infrastruktury a klíčové technologické platformy s doloženou etickou praxí, a to formulářem. Cenu Google nezveřejnil. (Google DeepMind: Fairwind)

Benchmark / nasazeníVýsledek Gemini 3.8 Flash CyberSrovnání
CyberGym Pass@1 (hledání zranitelností v C/C++)86,2 %GPT-5.5-Cyber 85,6 %, Mythos 5 83,8 %, 3.5 Flash Cyber 77,5 %
CWE-Bench (opravy, pass@1)47,2 %Přední frontier model 47,8 %, za výrazně vyšší cenu
Tým Chrome Security2,6× více správných opravNež nejlepší větší komerční modely
Wiz (interní penetrační test)O 7,5 až 9,7 % vyšší záchytPři 2,3× až 5,2× nižší ceně
Zdroj: Agentpedia podle metodiky Google DeepMind.

Varianta Cyber podle dostupných zpráv našla v Chromu chybu, kterou inženýři 13 let přehlíželi. (Miraflow)

Standardní Gemini 3.8 Flash Google na CyberGym ani CWE-Bench netestoval, a proto ho nepoužívejte jako náhradu specializovaného bezpečnostního modelu. (Miraflow)

07Cena a dostupnost Gemini 3.8 Flash

Gemini 3.8 Flash stojí do konce roku 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů. Od 1. ledna 2027 se cena zdvojnásobí.

ModelVstup (za 1 mil. tokenů)Výstup (za 1 mil. tokenů)
Gemini 3.8 Flash, úvodní cena (do 31. 12. 2026)0,75 USD3,75 USD
Gemini 3.8 Flash od 1. 1. 20271,50 USD7,50 USD
Claude Sonnet 52,00 USD10,00 USD
GPT-5.6 Sol4,00 USD20,00 USD
Claude Opus 5.54,00 USD20,00 USD
Claude Opus 5 (starší generace)5,00 USD25,00 USD
GPT-6 Astra / Claude Fable 5.110,00 USD50,00 USD
Zdroje: Agentpedia, OpenAI, Anthropic, Claude: ceník API

Rozpočty plánujte podle ceny od ledna 2027, ne podle úvodní. I po zdražení je 3.8 Flash na vstupu 1,3× až 6,7× levnější než konkurenti v tabulce. Stejný harmonogram zdražení platí i pro Gemini 3.7 Flash. (Agentpedia)

Model je dostupný v Gemini API a Google AI Studio. V aplikaci Gemini, nově i ve verzi pro Windows, ho mají předplatitelé Pro a Ultra. (BenchLM, The Soo Group)

08Pro koho se Gemini 3.8 Flash vyplatí

Gemini 3.8 Flash se vyplatí všude, kde běží hodně agentních úloh a rozhoduje cena za úlohu. Na nejtěžší obecné úlohy sáhněte po větším modelu.

SituaceDoporučeníProč
Programovací agenti, opravy testů, CIGemini 3.8 FlashDeepSWE na úrovni Opus 5 za zlomek ceny
Finance, právo, biologieGemini 3.8 FlashVede Vals Finance, Harvey Legal i LABBench2
Dlouhé dokumenty a videaGemini 3.8 Flash1 mil. tokenů, agentní zpracování videa
Velký objem jednoduchých dotazůGemini 3.5 Flash-LiteNejlevnější varianta
Ovládání počítače, obecný agentGPT-6 Astra nebo Claude Opus 5.53.8 Flash má jen 59 % na OSWorld a 19 % na Terminal-Bench 4.0
Nejtěžší kód a výzkumClaude Fable 5.1 nebo GPT-6 AstraVyšší obecná inteligence
Hluboké uvažování v ekosystému GoogleGemini 3.1 Pro nebo 3 Deep ThinkNejsilnější modely Google
Kybernetická obranaGemini 3.8 Flash Cyber (Fairwind)Specializovaný model

Doporučení vychází z benchmarků výše (Agentpedia). Před migrací produkce vždy otestujte model na vlastních úlohách.

09Jak psát prompty pro Gemini 3.8 Flash

Gemini 3.8 Flash je stavěný na agentní smyčky, takže mu zadávejte cíl a způsob ověření, ne jednotlivé kroky.

  1. Začněte na středním uvažování. Střední dá v indexu v4.3 40 bodů místo 41, úloha ale vyjde asi o čtvrtinu levněji (0,93 proti 1,24 USD); vysoké zapínejte jen tam, kde výsledek nestačí. Nízké (33 bodů) nechte na jednoduché úlohy. (Artificial Analysis)
  2. Definujte, kdy je hotovo. Například „všechny testy projdou, žádné nové závislosti“. Model pak iteruje, dokud podmínku nesplní.
  3. Využijte dlouhý kontext. Vložte celý dokument, smlouvu nebo video místo výňatků; model s 1 mil. tokenů zvládne celek.
  4. U videa zapněte agentní zpracování. Model si sám vybere důležité úseky místo pevného vzorkování.
  5. Hlídejte délku výstupu. Limit je 65 536 tokenů, dlouhé generování (celé moduly, reporty) rozdělte do více kroků.
  6. Měřte cenu za úlohu, ne za token. Vyšší úroveň uvažování prodlužuje úlohu; průměr na vysoké je kolem 2,5 minuty.

10Často kladené otázky o Gemini 3.8 Flash

Co je Gemini 3.8 Flash?

Rychlý a levný model Google DeepMind vydaný 2. září 2026, zaměřený na programování, agentní úlohy a vícekrokové uvažování. Google ho označuje za svůj dosud nejchytřejší model řady Flash.

Kolik stojí Gemini 3.8 Flash?

Do 31. 12. 2026 platí úvodní cena 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů. Od 1. 1. 2027 to bude 1,50 a 7,50 USD.

Jaké kontextové okno má Gemini 3.8 Flash?

1 milion tokenů na vstupu a až 65 536 tokenů na výstupu.

Existuje Gemini 3.8 Pro?

Zatím ne. Nejnovější verze Pro je Gemini 3.1 Pro z 19. února 2026, v API zatím jako náhled.

Je Gemini 3.8 Flash lepší než Claude nebo GPT?

V dlouhých softwarových úlohách (DeepSWE) dosahuje úrovně Claude Opus 5 a GPT-6 Astra za zlomek ceny. V ovládání počítače a obecné inteligenci za nimi zaostává.

Co je Gemini 3.8 Flash Cyber?

Varianta pro hledání a opravy zranitelností, dostupná jen důvěryhodným obráncům přes program Fairwind. Na CyberGym má 86,2 %.

11Verdikt: vyplatí se Gemini 3.8 Flash?

Gemini 3.8 Flash je v září 2026 nejlepší poměr výkonu a ceny pro agentní programování a práci s dlouhými dokumenty. V kódu dosahuje velkých modelů a stojí zlomek jejich ceny.

Není to ale univerzální vítěz. Na ovládání počítače a obecné agentní úlohy mají navrch GPT-6 Astra a modely Claude, a úvodní cena v lednu 2027 skončí. Pokud škálujete agenty a hlídáte náklady, začněte u 3.8 Flash; na nejtěžší úlohy mějte v záloze větší model.

Chcete AI agenty zapojit do vlastních procesů? S výběrem modelu i napojením na vaše systémy pomůžeme v rámci AI implementace.

12Zdroje

Tým LISTIFYWeby, aplikace a marketing z Prahy od roku 2008

Další články

Všechny články →
Umělá inteligence26. 9. 2026 · 12 min čtení

GPT-6 Astra (ChatGPT 6): technický průvodce, benchmarky, API, cena a přístup

Umělá inteligence26. 9. 2026 · 13 min čtení

Claude Fable 5.1: technický průvodce, benchmarky, API, cena a srovnání

Umělá inteligence26. 9. 2026 · 10 min čtení

Grok 4.7: technický průvodce, benchmarky, API, cena a srovnání

Sdílet stránku

E-mailem

Máte nápad? Za 15 minut víte, jak na něj.

Krátký hovor, žádná prezentace. Řekneme vám, co dává smysl, kolik to bude stát a jak rychle to zvládneme.

+420 771 166 199Po až Pá 8:30 až 16:00 · info@listify.cool

Kdy vám máme zavolat?

Vyberte den a časové rozmezí. Zavoláme my, hovor trvá zhruba 15 minut.

Den