Preskočiť na obsah
Umelá inteligencia

Najlepšie AI modely septembra 2026: veľké porovnanie GPT-6 Astra, Claude Fable 5.1, Gemini, Grok, Muse, DeepSeek a MiMo

Za tri septembrové týždne vyšlo sedem špičkových AI modelov a žiadny z nich nevyhráva vo všetkom. GPT-6 Astra a Claude Fable 5.1 majú v nezávislom indexe zhodne najviac bodov, Astra najlepšie ovláda počítač, Muse Spark 1.3 má podľa Mety najvyššie skóre v dlhom programovaní, MiMo V2.6 Pro je najlepší otvorený model a DeepSeek-V4.1-Flash je mimo špičky najlacnejší. Porovnali sme ich v cenách, architektúre a desiatich benchmarkoch.

Obálka porovnania 7 AI modelov september 2026: vyšli za tri týždne, GPT-6 Astra a Claude Fable 5.1 majú v indexe AA 53 bodov, vlajkové modely stoja 46-krát viac ako MiMo

01Kto v čom vyhráva

KategóriaVíťazKľúčové číslo
Všeobecná inteligenciaGPT-6 Astra a Claude Fable 5.1zhodne 53 bodov v AA Intelligence Index v4.3
Ovládanie počítačaGPT-6 Astra72,6 % v OSWorld 2.0
Matematika a vedaGPT-6 Astra97,6 % vo FrontierMath Tier 4
Dlhé programátorské úlohyMuse Spark 1.375,4 % v DeepSWE v1.1 (údaj Mety)
Agent v termináliGPT-6 Astra57,9 % v Terminal-Bench 4.0
Otvorený modelMiMo V2.6 Pro46 bodov v AA Intelligence Index v4.3
Najnižšia cenaDeepSeek-V4.1-Flash mimo špičky0,15 / 0,60 USD
Cena a výkon pri uzavretých modelochGemini 3.8 Flash73,7 % v DeepSWE za 0,75 / 3,75 USD
Ceny sú za milión vstupných / výstupných tokenov. Čísla pochádzajú od výrobcov a z nezávislých meraní, zdroje uvádzame pri každej kapitole. V špičke stojí DeepSeek 0,30 / 1,20 USD a najlacnejší je potom MiMo V2.6 Pro.

Každému modelu sme venovali samostatného sprievodcu, odkazy nájdete v prehľadovej tabuľke nižšie. Tu ich porovnávame vedľa seba.

02Prehľad: 7 AI modelov v jednej tabuľke

Štyri americké firmy, Meta a dvaja hráči z Číny vydali za tri týždne modely, ktorých ceny sa líšia až osemdesiatnásobne. Otvorené váhy pod licenciou MIT majú len DeepSeek a MiMo.

ModelVýrobcaVydanýVáhyKontextVstup / výstup (USD za 1 mil.)
GPT-6 AstraOpenAI3. 9. 2026uzavreté1,05 mil.10 / 50
Claude Fable 5.1Anthropic1. 9. 2026uzavreté1 mil.10 / 50
Gemini 3.8 FlashGoogle2. 9. 2026uzavreté1 mil.0,75 / 3,75 (do konca 2026)
Grok 4.7xAI (SpaceXAI)21. 9. 2026uzavreté500 tis.2 / 6
Muse Spark 1.3Meta2. 9. 2026uzavreté1,05 mil.1,25 / 4,25
DeepSeek-V4.1-FlashDeepSeek10. 9. 2026otvorené (MIT)1 mil.0,30 / 1,20 (v špičke)
MiMo V2.6 ProXiaomi22. 9. 2026otvorené (MIT)1 mil.0,435 / 0,87
Zdroje: OpenAI, Anthropic, Agentpedia, xAI, Meta, Hugging Face, Xiaomi. GPT-6 Astra bola 3. 9. v obmedzenej ukážke, všetkým sa otvorila 4. 9.

Mimo porovnania: 22. septembra vyšiel ešte Claude Opus 5.5. Stojí 4 / 20 USD a v indexe Artificial Analysis v4.3 vedie celý rebríček s 58 bodmi, podľa Anthropicu pracuje na úrovni Fable 5.1 za nižšiu cenu. V ten istý deň OpenAI pridala modely GPT-6 Sol a GPT-6 Luna. Porovnanie sa drží siedmich modelov zo začiatku a polovice septembra, Opus 5.5 ukazujeme pre kontext v grafe inteligencie. (Anthropic)

03Časová os: september 2026 deň po dni

Časová os septembra 2026: 1. 9. Claude Fable 5.1, 2. 9. Gemini 3.8 Flash a Muse Spark 1.3, 3. 9. GPT-6 Astra, 10. 9. DeepSeek-V4.1-Flash s otvorenými váhami, 21. 9. Grok 4.7 a 22. 9. MiMo V2.6 Pro s otvorenými váhami
Dátumy vydania podľa oznámení výrobcov. Červenou modely s otvorenými váhami.

Za prvé tri septembrové dni vyšli štyri modely. Anthropic začal 1. septembra, Google a Meta pridali svoje o deň neskôr a OpenAI tretieho. GPT-6 Astra bola najprv len v obmedzenej ukážke, všetkým používateľom sa otvorila 4. septembra. Otvorené modely z Číny prišli neskôr: DeepSeek 10. septembra, Xiaomi až 22. septembra, deň po Groku.

04Architektúra a kontextové okno

OpenAI, Anthropic, Google ani Meta počet parametrov nezverejňujú. Čínske otvorené modely naopak ukazujú všetko: oba stavajú na architektúre mixture-of-experts (MoE), pri ktorej na každom tokene pracuje len malá časť siete.

ModelParametre spoluAktívne na tokenArchitektúraMax. výstupVstupy
GPT-6 Astranezverejnenénezverejnenénezverejnené128 tis.neuvedené
Claude Fable 5.1nezverejnenénezverejnenéadaptívne uvažovanie128 tis.neuvedené
Gemini 3.8 Flashnezverejnenénezverejnenénezverejnené65 536text, obrázky, zvuk, video, dokumenty
Grok 4.7asi 2,1 bil. (podľa Elona Muska)nezverejnenénový väčší základný modelbez pevného limitutext, obrázky
Muse Spark 1.3nezverejnenénezverejnenénatívne multimodálnyneuvedenétext, obrázky, video, PDF, zvuk obmedzene
DeepSeek-V4.1-Flash552 mld. + 196 mld. Engram8 mld. (vstup), 16 mld. (generovanie)MoE, kauzálny enkodér a dekodér384 tis.text, obrázky
MiMo V2.6 Pro1,02 bil.42 mld.MoE so zmrazeným routerom128 tis.text, obrázky, video, zvuk
Zdroje: OpenAI, Anthropic, Agentpedia, xAI, Meta, Hugging Face, DeepSeek API, Xiaomi. Počet parametrov Groku uviedol Elon Musk, xAI ho oficiálne nepotvrdila.
Kontextové okno (tisíce tokenov)
  • GPT-6 Astra1 050
  • Muse Spark 1.31 049
  • Claude Fable 5.11 000
  • Gemini 3.8 Flash1 000
  • DeepSeek-V4.1-Flash1 000
  • MiMo V2.6 Pro1 000
  • Grok 4.7500

Zdroj: dokumentácia výrobcov. Muse Spark 1.3 má presne 1 048 576 tokenov. Grok 4.7 má ako jediný polovičné okno a od 200 tisíc tokenov účtuje dvojnásobnú cenu.

Do milióna tokenov sa zmestí stredne veľký repozitár alebo niekoľko stoviek strán dokumentov. Rozdiel je v tom, koľko dlhý kontext stojí. Muse Spark 1.3 si za plné okno nič nepripočítava, Grok 4.7 od 200 tisíc tokenov účtuje dvojnásobok. DeepSeek vďaka kompresii potrebuje na token len 890 bajtov pamäte KV cache, a preto je lacný aj pri agentoch s obrovským vstupom.

05Ceny API: ktorý AI model je najlacnejší

Najlacnejšie sú otvorené modely z Číny. MiMo V2.6 Pro stojí za milión vstupných a milión výstupných tokenov spolu 1,31 USD, GPT-6 Astra a Claude Fable 5.1 60 USD, teda približne 46-krát viac. DeepSeek-V4.1-Flash stojí v špičke 1,50 USD a mimo špičky polovicu.

Cena za 1 mil. vstupných + 1 mil. výstupných tokenov
  • GPT-6 Astra60,00 USD
  • Claude Fable 5.160,00 USD
  • Grok 4.78,00 USD
  • Muse Spark 1.35,50 USD
  • Gemini 3.8 Flash4,50 USD
  • DeepSeek-V4.1-Flash (špička)1,50 USD
  • MiMo V2.6 Pro1,31 USD
  • DeepSeek-V4.1-Flash (mimo špičky)0,75 USD

Podľa cenníkov výrobcov. Gemini za úvodnú cenu platnú do konca roka 2026, Grok pre prompty do 200 tisíc tokenov, Muse v tarife Standard. Špička DeepSeeku sú pracovné dni 1:00 až 4:00 a 6:00 až 10:00 UTC.

Lacná päťka: cena vstupu a výstupu za 1 mil. tokenov
  • Grok 4.7Vstup: 2,00 USDVýstup: 6,00 USD
  • Muse Spark 1.3Vstup: 1,25 USDVýstup: 4,25 USD
  • Gemini 3.8 FlashVstup: 0,75 USDVýstup: 3,75 USD
  • DeepSeek-V4.1-Flash (špička)Vstup: 0,30 USDVýstup: 1,20 USD
  • MiMo V2.6 ProVstup: 0,43 USDVýstup: 0,87 USD

GPT-6 Astra a Claude Fable 5.1 (10 / 50 USD) by sa do mierky nezmestili. MiMo V2.6 Pro má vstup presne 0,435 USD.

Podrobný cenník

ModelVstupVstup z cacheVýstupPoznámka
GPT-6 Astra10 USD1 USD50 USDrežim Fast za dvojnásobok
Claude Fable 5.110 USD0,25 USD50 USDnajlacnejšia cache spomedzi vlajkových modelov
Grok 4.72 USD0,50 USD6 USDod 200 tis. tokenov dvojnásobok; OpenRouter 1,60 / 4,80 USD
Muse Spark 1.31,25 USD0,15 USD4,25 USDtarif Contributor 0,10 / 0,20 USD, Meta však trénuje na vašich údajoch
Gemini 3.8 Flash0,75 USDneuvedené3,75 USDod 1. 1. 2027 za 1,50 / 7,50 USD
DeepSeek-V4.1-Flash0,30 USD0,006 USD1,20 USDmimo špičky za polovicu
MiMo V2.6 Pro0,435 USD0,0036 USD0,87 USDverzia Flash za 0,14 / 0,28 USD
Ceny za 1 mil. tokenov. Zdroje: OpenAI, Anthropic, xAI, OpenRouter, Meta, Agentpedia, DeepSeek API, Xiaomi.

Cena za token nie je cena za úlohu. GPT-6 Astra aj Muse Spark 1.3 potrebujú na rovnakú prácu menej tokenov ako ich predchodcovia a Claude Fable 5.1 vďaka lacnej cache vychádza pri agentoch o 25 až 45 % lacnejšie ako Fable 5. Skutočný rozdiel na faktúre preto býva menší, ako ukazuje graf. Pri plánovaní rozpočtu na rok 2027 počítajte s drahším Gemini 3.8 Flash.

06Celková inteligencia: ktorý AI model je najinteligentnejší

V nezávislom Artificial Analysis Intelligence Index v4.3 sa o prvé miesto spomedzi siedmich modelov delia GPT-6 Astra a Claude Fable 5.1 s 53 bodmi. Najlepší otvorený model je MiMo V2.6 Pro so 46 bodmi. Celý rebríček však vedie Claude Opus 5.5, ktorý vyšiel 22. septembra.

Artificial Analysis Intelligence Index v4.3 (body)
  • Claude Opus 5.5 (mimo porovnania)58
  • GPT-6 Astra53
  • Claude Fable 5.153
  • Muse Spark 1.3 (max)48
  • Grok 4.746
  • MiMo V2.6 Pro46
  • Gemini 3.8 Flash41
  • DeepSeek-V4.1-Flash39

Zdroj: Artificial Analysis, stav k 27. 9. 2026. Grok 4.7 má po zaokrúhlení tesne viac ako MiMo (46,45 oproti 46,32). Muse Spark 1.3 na úrovni xhigh má 45 bodov.

Pozor na staršiu verziu indexu. Do začiatku septembra platila verzia v4.1 s inou stupnicou a mnohé články ju stále citujú: Claude Fable 5.1 tam mal 65,7 bodu a GPT-6 Astra 61,2. Verzia v4.3 hodnotí prísnejšie a body medzi verziami sa nedajú prepočítať ani miešať v jednom porovnaní. V tomto článku používame len v4.3, rovnako ako v našich sprievodcoch.

Rozdiel 53 oproti 46 bodom je zreteľný, ale v bežnej práci ho nepoznáte pri každej úlohe. Viac napovedia výsledky v oblasti, ktorú potrebujete, preto ich rozoberáme v ďalších kapitolách.

07Programovanie: najlepší AI model na kód

V dlhých programátorských úlohách (DeepSWE) sú modely takmer vyrovnané a lacné modely dobehli vlajkové. Rozdiel sa ukáže až v ťažšom teste agenta v termináli. V Terminal-Bench 4.0 majú GPT-6 Astra a Claude Fable 5.1 o polovicu až trojnásobne vyššiu úspešnosť ako lacnejšie modely.

DeepSWE v1.1: dlhé agentné softvérové úlohy
  • Muse Spark 1.375,4 %
  • DeepSeek-V4.1-Flash74,2 %
  • GPT-6 Astra74,1 %
  • Gemini 3.8 Flash73,7 %
  • MiMo V2.6 Pro71,9 %
  • Grok 4.771,0 %
  • Claude Fable 5.167,4 %

Údaje výrobcov, každý meral vo vlastnom prostredí, porovnanie je orientačné. Claude Fable 5.1 podľa tabuľky OpenAI; xAI uvádza 70,0 %, Anthropic číslo nezverejnil.

Terminal-Bench 4.0: všeobecný agent v termináli
  • GPT-6 Astra57,9 %
  • Claude Fable 5.155,8 %
  • Grok 4.737,6 %
  • MiMo V2.6 Pro34,9 %
  • DeepSeek-V4.1-Flash31,2 %
  • Gemini 3.8 Flash19,1 %

Údaje výrobcov: OpenAI, Anthropic, xAI, Xiaomi, Hugging Face, Agentpedia. Muse Spark 1.3 výsledok nezverejnil.

Terminal-Bench 2.1: staršia verzia testu
  • DeepSeek-V4.1-Flash90,6 %
  • MiMo V2.6 Pro89,9 %
  • Gemini 3.8 Flash89,4 %
  • Muse Spark 1.388,8 %

Údaje výrobcov. GPT-6 Astra, Claude Fable 5.1 a Grok 4.7 výsledok v tejto verzii nezverejnili.

  • DeepSWE už takmer nerozlišuje. Šesť zo siedmich modelov sa zmestilo medzi 71 a 75,4 %, Claude Fable 5.1 má podľa tabuľky OpenAI 67,4 %. Najvyššie skóre Muse Spark 1.3 je navyše meranie Mety, ktoré zatiaľ nie je vo verejnom rebríčku DeepSWE.
  • Terminal-Bench 4.0 oddeľuje triedy. GPT-6 Astra (57,9 %) a Claude Fable 5.1 (55,8 %) sú tam, kam lacnejšie modely zatiaľ nesiahajú. Grok 4.7 má 37,6 %, Gemini 3.8 Flash 19,1 %.
  • Terminal-Bench 2.1 je nasýtený. Lacné modely sa v ňom tlačia okolo 90 % a test medzi nimi nič neodlíši.
  • Nezávislé merania: CursorBench 3.2 dáva Claude Fable 5.1 73,4 % a Gemini 3.8 Flash 69,2 % (BenchLM), AA Coding Agent Index dáva Fable 5.1 70 bodov a GPT-6 Astra 67 (MindStudio).

Na bežné opravy chýb a menšie úpravy kódu stačí lacný model. Na samostatnú prácu v termináli, ktorá trvá hodiny, sa vlajkové modely stále oplatia.

08Ovládanie počítača a AI agenti

V ovládaní počítača vedie podľa porovnávacej tabuľky OpenAI GPT-6 Astra so 72,6 % v OSWorld 2.0. Anthropic hlási pre Claude Fable 5.1 ešte vyššie číslo, lenže na inej sade úloh. V teste firemných procesov AutomationBench lacné modely podľa vlastných meraní vychádzajú lepšie ako GPT-6 Astra aj Claude Fable 5.1.

OSWorld 2.0: ovládanie počítača (čísla výrobcov)
  • Claude Fable 5.1 (partial, sada Anthropicu)77,9 %
  • GPT-6 Astra72,6 %
  • Muse Spark 1.3 max (partial)66,9 %
  • Gemini 3.8 Flash59,0 %

Každý výrobca meral na inej sade úloh alebo s iným hodnotením, čísla teda nie sú priamo porovnateľné. Anthropic meral na augustovej sade 2026 (v prísnom variante strict má Fable 5.1 41,7 %). Grok, DeepSeek a MiMo výsledok nezverejnili.

AutomationBench: firemné procesy
  • DeepSeek-V4.1-Flash54,8 %
  • MiMo V2.6 Pro53,1 %
  • Muse Spark 1.349,6 %
  • GPT-6 Astra41,4 %
  • Claude Fable 5.131,4 %

Údaje výrobcov: Hugging Face, Xiaomi, Meta, OpenAI, Anthropic. Verzia testu sa môže u výrobcov líšiť.

  • OSWorld nie je jeden test. Anthropic meral na augustovej sade úloh a uvádza variant partial. OpenAI meralo vo vlastnej konfigurácii a Meta verziu max. V tabuľke OpenAI má GPT-6 Astra 72,6 % a Claude Opus 5 70,2 %, preto ju v ovládaní počítača uvádzame ako víťaza.
  • Astra je najrýchlejšia. Úlohu v OSWorld 2.0 zvládne približne za 40 minút, GPT-5.6 Sol za 75.
  • Výsledky lacných modelov v AutomationBench treba overiť. DeepSeek (54,8 %), MiMo (53,1 %) aj Muse (49,6 %) uvádzajú svoje čísla sami. Pri Claude Fable 5.1 (31,4 %) sa čísla OpenAI a Anthropicu zhodujú, GPT-6 Astra (41,4 %) je údaj OpenAI. Xiaomi v novšej verzii testu uvádza pre Astru 52,0 %.
  • Hotové produkty s ovládaním počítača ponúkajú najmä OpenAI (ChatGPT Work, Codex) a Anthropic (Claude Code, Claude Cowork). Pri otvorených modeloch si agentné prostredie zvyčajne postavíte sami.

09Veda, matematika a uvažovanie

Vo vedeckých otázkach sú modely takmer vyrovnané. V najťažšej matematike jasne vedie GPT-6 Astra, v multidisciplinárnom teste Humanity’s Last Exam Claude Fable 5.1.

GPQA Diamond: vedecké otázky na úrovni doktorátu
  • GPT-6 Astra96,0 %
  • Gemini 3.8 Flash95,3 %
  • Claude Fable 5.193,7 %
  • DeepSeek-V4.1-Flash90,9 %

Údaje výrobcov, Gemini 3.8 Flash podľa merania Artificial Analysis (Google hodnotu neuvádza).

Humanity’s Last Exam s nástrojmi
  • Claude Fable 5.165,0 %
  • DeepSeek-V4.1-Flash63,9 %
  • GPT-6 Astra57,2 %

Údaje výrobcov. Ostatné modely tento variant testu nezverejnili.

Najťažšie testy zverejnili len OpenAI a Anthropic

BenchmarkGPT-6 AstraClaude Fable 5.1Čo meria
FrontierMath Tier 4 (v2)97,6 %87,8 %výskumná matematika
Terminal-Bench Science 0.164,6 %52,6 %vedecký výskum v termináli
ARC-AGI-295,0 %90,0 %abstraktné uvažovanie
ARC-AGI-399,9 % v upravenom prostredí, 62,7 % v štandardnom testeneuvedenéabstraktné uvažovanie
Zdroje: OpenAI, MindStudio. Podrobnosti v sprievodcovi GPT-6 Astra a sprievodcovi Claude Fable 5.1.

OpenAI zverejnila s Astrou nové výsledky o medzerách medzi prvočíslami a sama žiada matematikov o ich preverenie; z 68 nevyriešených Erdősových problémov Astra oficiálne vyriešila dva. Claude Fable 5.1 viac ako zdvojnásobil skóre Fable 5 v Terminal-Bench Science. Xiaomi ukazuje formalizáciu vety v jazyku Lean 4 s vyše 6 000 riadkami overeného kódu. Spoľahlivý samostatný výskum však zatiaľ nezvláda žiadny z modelov. (OpenAI, Anthropic, Xiaomi)

10Kybernetická bezpečnosť a ochranné opatrenia

Najsilnejšie výsledky v hľadaní zraniteľností hlásia otvorené modely, ktoré však nemajú žiadne centrálne poistky. Vlajkové modely sú naopak strážené najprísnejšie. GPT-6 Astra ako prvý model OpenAI dosiahla „kritickú“ úroveň kybernetických schopností, a verejná verzia preto odmieta písať exploity.

CyberGym: hľadanie zraniteľností
  • MiMo V2.6 Pro94,0 %
  • DeepSeek-V4.1-Flash88,1 %
  • Gemini 3.8 Flash Cyber86,2 %

Údaje výrobcov: Xiaomi, Hugging Face, Agentpedia. Pri Gemini ide o špecializovanú verziu Cyber. OpenAI, Anthropic, xAI a Meta výsledok nezverejnili.

Nebezpečné akcie pri ovládaní počítača (nižšie je lepšie)
  • GPT-5.6 Sol (starší)22,0 %
  • Claude Opus 5 (starší)11,5 %
  • Claude Fable 5.19,5 %
  • GPT-6 Astra2,4 %

Interný test OpenAI bez produkčných poistiek, teda meranie jedného z konkurentov.

Ako k bezpečnosti pristupujú výrobcovia

ModelPrístupSilnejšia verzia pre overených
GPT-6 Astraodmieta exploity, klasifikátory zastavia neautorizovanú činnosťprogram Daybreak (pripravuje sa)
Claude Fable 5.1citlivé kybernetické požiadavky odovzdá slabšiemu modelu Opus, hľadanie zraniteľností je povolenéClaude Mythos 5.1, zatiaľ len v programe pre vedy o živej prírode; kybernetický program ponúka Opus a Sonnet
Gemini 3.8 Flashštandardný model v kybernetických testoch nemeranýGemini 3.8 Flash Cyber v programe Fairwind
Grok 4.7nová sada poistiek, v internom teste prešlo 3,3 % rizikových požiadaviekred-team schopnosti na pozvanie
Muse Spark 1.3podľa Mety odolnejší voči prompt injection a opatrný pri nevratných akciáchneuvedené
DeepSeek-V4.1-Flashotvorené váhy, pri vlastnej prevádzke žiadne centrálne poistkynie je potrebná
MiMo V2.6 Prootvorené váhy, nezávislých testov je zatiaľ málonie je potrebná
Zdroje: OpenAI, Anthropic, Agentpedia, xAI, TrueFoundry, MindStudio, Xiaomi.

Pri otvorených modeloch za pravidlá používania zodpovedáte sami. Pri uzavretých počítajte s tým, že legitímna bezpečnostná práca, napríklad penetračné testy alebo vývoj exploitov, narazí na odmietnutie, kým nezískate prístup k špeciálnej verzii.

11Otvorené a uzavreté modely: kam putujú vaše údaje

Ak údaje nesmú opustiť vašu infraštruktúru, zostávajú DeepSeek-V4.1-Flash a MiMo V2.6 Pro. Oba majú otvorené váhy pod licenciou MIT a dajú sa prevádzkovať na vlastných serveroch. Pri všetkých ostatných idú prompty vždy k výrobcovi alebo jeho cloudovému partnerovi.

ModelVáhyKde bežíOchrana údajov
GPT-6 AstrauzavretéOpenAI API, Microsoft Azure, Amazon BedrockZero Data Retention pre vybraných zákazníkov
Claude Fable 5.1uzavretéClaude API, Amazon Bedrock, Google Cloud, Microsoft FoundryZero Data Retention pre oprávnených zákazníkov
Gemini 3.8 FlashuzavretéGemini API, Google AI Studio, aplikácia Geminipodľa podmienok Google
Grok 4.7uzavretéxAI API, OpenRouter, Vercel, Cloudflareregionálny endpoint v USA za príplatok 10 %
Muse Spark 1.3uzavretéMeta Model API, OpenRouter, LLM Gatewayv tarife Contributor Meta trénuje na vašich údajoch, nastavenie v Muse Code si skontrolujte
DeepSeek-V4.1-Flashotvorené (MIT)vlastné servery, tretie strany (napr. NVIDIA), priame APIpriame API prevádzkuje firma so sídlom v Číne
MiMo V2.6 Prootvorené (MIT)vlastné servery, OpenRouter, API XiaomiAPI Xiaomi beží na čínskych serveroch
Zdroje: OpenAI, Anthropic, BenchLM, xAI, TrueFoundry, MindStudio, Xiaomi.

Vlastná prevádzka nie je zadarmo. DeepSeek-V4.1-Flash má 552 miliárd parametrov a aj kvantizovaná verzia potrebuje stovky gigabajtov pamäte. Komunitné zostavenie beží napríklad na dvoch kartách RTX PRO 6000 s 96 GB. MiMo V2.6 Pro s 1,02 bilióna parametrov je ešte náročnejší, praktickejší je menší MiMo V2.6 Flash s 309 miliardami. (MindStudio)

Pre firmy v EÚ: model prevádzkovaný na vlastnej infraštruktúre v Európe rieši otázku, kam údaje odchádzajú. Pri API všetkých výrobcov si konkrétne podmienky spracovania overte s právnikom.

12Výkon za dolár: najvýhodnejší AI model

V programovaní dostanete takmer rovnaký výsledok za zlomok ceny. DeepSeek-V4.1-Flash má v DeepSWE rovnaké skóre ako GPT-6 Astra a aj v špičke stojí štyridsatinu.

Bodový graf ceny oproti skóre v DeepSWE v1.1: MiMo 1,31 USD a 71,9 %, DeepSeek 1,50 USD a 74,2 %, Gemini 4,50 USD a 73,7 %, Muse 5,50 USD a 75,4 %, Grok 8 USD a 71,0 %, GPT-6 Astra 60 USD a 74,1 %, Claude Fable 5.1 60 USD a 67,4 %
Vodorovná os je logaritmická, vľavo hore je najviac výkonu za dolár. Skóre DeepSWE uvádzajú výrobcovia, DeepSeek v cene v špičke.

Graf má dve obmedzenia. DeepSWE meria len dlhé softvérové úlohy; v ťažšom Terminal-Bench 4.0 majú GPT-6 Astra a Claude Fable 5.1 veľký náskok (57,9 a 55,8 % oproti 31,2 % pri DeepSeeku). A lacný model, ktorý úlohu vyrieši až na tretí pokus, môže nakoniec vyjsť drahšie ako drahý, ktorý ju zvládne na prvý raz. Merajte preto cenu za prijateľnú odpoveď na vlastných úlohách.

13Ktorý AI model zvoliť

Najlepší model na všetko neexistuje. Rozhoduje, čo od neho potrebujete, a pomôžu vám tri otázky:

Ako vybrať AI model v troch otázkach: ak musia údaje zostať na vašich serveroch, tak DeepSeek alebo MiMo; hodiny samostatnej práce alebo ovládanie počítača, tak GPT-6 Astra alebo Claude Fable 5.1; ak rozhoduje hlavne cena, tak Gemini 3.8 Flash alebo Grok 4.7; inak model podľa odboru
Zjednodušené odporúčanie podľa stavu v septembri 2026.

Odporúčania podľa scenára

ScenárOdporúčaniePrečo
Automatizácia práce v aplikáciách bez APIGPT-6 Astra72,6 % v OSWorld 2.0, hotové prostredie ChatGPT Work
Veľké zmeny kódu, nočné behy agentov, výskumClaude Fable 5.153 bodov v AA indexe, silný v termináli, lacná cache
Matematika a vedecké výpočtyGPT-6 Astra97,6 % vo FrontierMath Tier 4
Programátorskí agenti vo veľkom a lacnoGemini 3.8 Flash alebo DeepSeek-V4.1-Flashvyše 73 % v DeepSWE za zlomok ceny
Analýza obrovského repozitára alebo dokumentovMuse Spark 1.398,1 % v MRCR do 1 mil. tokenov, bez príplatku za dlhý kontext
Právne a inžinierske agentné úlohyGrok 4.7vedie v Harvey Legal, v EEBench je druhý za GPT-6 Astra
Financie a biológiaGemini 3.8 Flashvedie vo Vals Finance aj LABBench2
Údaje musia zostať na vlastných serverochDeepSeek-V4.1-Flash alebo MiMo V2.6 Prootvorené váhy pod licenciou MIT
Text, obrázky, video aj zvuk v jednom otvorenom modeliMiMo V2.6 Pronatívna podpora všetkých typov vstupu
Hľadanie zraniteľností v kódeMiMo V2.6 Pro alebo DeepSeek-V4.1-Flash94 % a 88,1 % v CyberGym (údaje výrobcov)

Skôr ako sa rozhodnete, vyskúšajte dvoch alebo troch kandidátov na vlastných úlohách a porovnajte cenu za prijateľnú odpoveď. Ak chcete zapojiť AI do firemných procesov a neviete, kde začať, pomôžeme s AI implementáciou.

14Časté otázky

Aký je najlepší AI model v septembri 2026?

Zo siedmich porovnávaných modelov majú v nezávislom Artificial Analysis Intelligence Index v4.3 najviac bodov GPT-6 Astra a Claude Fable 5.1, zhodne 53. Astra vedie v ovládaní počítača a matematike, Fable 5.1 v Humanity’s Last Exam. Celý rebríček vedie Claude Opus 5.5 (58 bodov), ktorý vyšiel 22. septembra.

Je lepšia GPT-6 Astra, alebo Claude Fable 5.1?

Záleží od úlohy. V indexe Artificial Analysis v4.3 majú oba 53 bodov. Astra vedie v ovládaní počítača (72,6 % v OSWorld 2.0), matematike a Terminal-Bench 4.0, Fable 5.1 v Humanity’s Last Exam. V API stoja oba rovnako: 10 USD za milión vstupných a 50 USD za milión výstupných tokenov.

Ktorý AI model je najlacnejší?

Z porovnávaných modelov DeepSeek-V4.1-Flash mimo špičky (0,15 / 0,60 USD za milión tokenov). V špičke stojí 0,30 / 1,20 USD a lacnejší je MiMo V2.6 Pro (0,435 / 0,87 USD). Ešte lacnejší je menší MiMo V2.6 Flash za 0,14 / 0,28 USD.

Aký je najlepší open source AI model?

MiMo V2.6 Pro od Xiaomi. V Artificial Analysis Intelligence Index v4.3 má 46 bodov, najviac zo všetkých modelov s otvorenými váhami. DeepSeek-V4.1-Flash má 39 bodov, ale vyššie skóre v DeepSWE a nižšiu cenu mimo špičky.

Ktorý AI model je najlepší na programovanie?

V dlhých softvérových úlohách sú modely takmer vyrovnané: šesť zo siedmich má v DeepSWE 71 až 75,4 %, Claude Fable 5.1 67,4 %. Na samostatnú prácu v termináli vedú GPT-6 Astra (57,9 %) a Claude Fable 5.1 (55,8 %) v Terminal-Bench 4.0.

Ktorý model má najväčšie kontextové okno?

GPT-6 Astra (1,05 milióna tokenov) a Muse Spark 1.3 (1 048 576 tokenov). Ostatné majú 1 milión, len Grok 4.7 má 500 tisíc.

15Verdikt: trh sa rozdelil na tri poschodia

Hore sú GPT-6 Astra a Claude Fable 5.1. Z tejto sedmičky len im sa dá zveriť niekoľko hodín samostatnej práce na počítači alebo v termináli. Stoja však 46-krát viac ako MiMo V2.6 Pro. Kto chce podobnú inteligenciu lacnejšie, má od 22. septembra Claude Opus 5.5 za 4 / 20 USD.

V strede sú Gemini 3.8 Flash, Grok 4.7 a Muse Spark 1.3. V programovaní sa vlajkovým modelom vyrovnajú za siedmu až trinástinu ceny, na všeobecných agentov nestačia.

Cenou najnižšie, nie kvalitou, sú otvorené DeepSeek-V4.1-Flash a MiMo V2.6 Pro. V DeepSWE držia krok so špičkou, stoja zlomok a môžete ich prevádzkovať na vlastných serveroch.

Väčšine firiem sa oplatí kombinácia: lacný model na objem práce a vlajkový na najťažšie úlohy. Trh sa mení po týždňoch, preto je rozumné neviazať sa na jedného výrobcu.

Kto v čom vyhráva: inteligencia GPT-6 Astra a Claude Fable 5.1 s 53 bodmi, ovládanie počítača, matematika a terminál GPT-6 Astra, dlhé programovanie Muse Spark 1.3, otvorený model MiMo V2.6 Pro, najnižšia cena DeepSeek-V4.1-Flash, cena a výkon Gemini 3.8 Flash
Zhrnutie na jeden obrázok, môžete ho zdieľať.

16Zdroje

Tím LISTIFYWeby, aplikácie a marketing z Prahy od roku 2008

Ďalšie články

Všetky články →
Umelá inteligencia27. 9. 2026 · 11 min čítania

AI Act sa neodložil. Čo musí vaša firma riešiť už teraz

Umelá inteligencia26. 9. 2026 · 13 min čítania

GPT-6 Astra (ChatGPT 6): technický sprievodca, benchmarky, API, cena a prístup

Umelá inteligencia26. 9. 2026 · 14 min čítania

Claude Fable 5.1: technický sprievodca, benchmarky, API, cena a porovnanie

Zdieľať stránku

E-mailom

Máte nápad? Za 15 minút budete vedieť, ako na to.

Krátky hovor, žiadna prezentácia. Povieme vám, čo dáva zmysel, koľko to bude stáť a ako rýchlo to zvládneme.

+420 771 166 199Po až Pi 8:30 až 16:00 · info@listify.cool

Kedy vám máme zavolať?

Vyberte deň a časové rozmedzie. Zavoláme my, hovor trvá zhruba 15 minút.

Deň