V srpnu 2026 čelí firmy rozhodnutí mezi dvěma čerstvě dostupnými velkými jazykovými modely: Qwen3.8 Max od Alibaby a Grok 4.5 od xAI. Podle mediálního monitoringu Alibaba svůj model teprve nedávno uvolnila z uzavřeného testování do obecné dostupnosti. Srovnání vychází z benchmarkových dat: souhrnných indexů inteligence a kódování, čtyř hloubkových testů (HLE, GPQA Diamond, SciCode, LCR) a provozních parametrů · ceny za milion tokenů, rychlosti generování a doby do prvního tokenu. Cílem je ukázat, kde se modely reálně liší a kde je rozdíl zanedbatelný.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Kdo vede v indexech a benchmarcích
V souhrnném indexu inteligence dosahuje Qwen3.8 Max hodnoty 58,1, Grok 4.5 55,8 - rozdíl mezi nimi činí podle předpočítané hodnoty 2,3 bodu ve prospěch Qwenu. V indexu kódování se pořadí obrací: Grok 4.5 má 72,4 bodu, Qwen3.8 Max 71,8 bodu, jde ale o těsný odstup.
V hloubkových testech je obraz smíšenější. V HLE, který prověřuje expertní otázky napříč obory, vede Qwen3.8 Max s hodnotou 43 proti 42,7 u Grok 4.5 - relevantní spíše pro obecné znalostní a poradenské úlohy. V GPQA Diamond, testu vědeckých otázek doktorandské úrovně, má navrch Grok 4.5 s 93,1 proti 92,7 u Qwenu, což je důležité pro nasazení ve vědě a výzkumu.
V SciCode, benchmarku programování vědeckých algoritmů, je Grok 4.5 napřed s 54,1 proti 52,9 - jde o jeho největší zaznamenaný náskok, 1,2 procentního bodu, relevantní pro autonomní agenty řešící technické úlohy. V LCR, testu porozumění dlouhému kontextu, má naopak těsně navrch Qwen3.8 Max s 74,3 proti 74 u Grok 4.5 - největší náskok Qwenu, 0,3 procentního bodu, což hraje roli při práci s dlouhými dokumenty.
Co rychlost a cena znamenají v praxi
Cena obou modelů je podle dat totožná, 3 USD za milion tokenů, poměr cen je 1×. Rozhodovat tak nebude rozpočet, ale provozní parametry. Qwen3.8 Max generuje 66 tokenů za sekundu, Grok 4.5 49 tokenů za sekundu, poměr rychlostí činí 1,3× ve prospěch Qwenu. Ještě výraznější je rozdíl v době do prvního tokenu: Qwen3.8 Max odpovídá po 1,93 sekundy, Grok 4.5 až po 12,14 sekundy.
Pro nasazení, kde uživatel čeká na první znak odpovědi - chatovací rozhraní, interaktivní práce v terminálu, agentní smyčky s mnoha kroky - má tento rozdíl v TTFT v praxi větší váhu než rozdíly jednotek procentních bodů v HLE, GPQA Diamond nebo SciCode. Náskok 1,2 procentního bodu v SciCode neznamená, že Grok 4.5 je obecně lepší programátor - je to úspěšnost na konkrétní sadě vědeckých algoritmických úloh, a v jiném typu kódovacích úkolů se rozestup mezi modely v indexu kódování scvrkává na těsný odstup 71,8 proti 72,4.
Který model zvolit pro jaké nasazení
Pro firmy, kde je klíčová rychlá odezva - zákaznická podpora, chatboti, agentní nástroje pracující v reálném čase - dává smysl Qwen3.8 Max, díky nižšímu TTFT 1,93 sekundy a vyšší propustnosti 66 tokenů za sekundu. Pro vědecká a výzkumná pracoviště, kde rozhoduje přesnost na GPQA Diamond a SciCode, má mírně navrch Grok 4.5.
Cena obou modelů je stejná, takže volbu neurčí rozpočet. Pro práci s rozsáhlými dokumenty, smlouvami nebo dlouhými technickými specifikacemi je těsně napřed Qwen3.8 Max podle výsledku v LCR. Vzhledem k tomu, že rozdíly mezi modely se často pohybují v jednotkách procentních bodů, měly by české firmy před nasazením otestovat oba modely na vlastních datech a konkrétní úloze, než se spolehnou jen na souhrnné indexy.
Časté dotazy
Je Qwen3.8 Max levnější než Grok 4.5?
Ne, oba modely mají podle dat stejnou cenu 3 USD za milion tokenů, poměr cen je 1×. Rozdíl mezi modely tedy neleží v ceně, ale v rychlosti odezvy a v jednotlivých benchmarcích - Qwen3.8 Max generuje 66 tokenů za sekundu, Grok 4.5 49 tokenů za sekundu.
Který model je rychlejší, Qwen3.8 Max nebo Grok 4.5?
Qwen3.8 Max je podle dat rychlejší, poměr rychlostí činí 1,3×, s hodnotou 66 tokenů za sekundu proti 49 tokenům za sekundu u Grok 4.5. Ještě výraznější je rozdíl v čase do prvního tokenu: Qwen3.8 Max 1,93 sekundy, Grok 4.5 12,14 sekundy.
Je Grok 4.5 lepší v kódování než Qwen3.8 Max?
V souhrnném indexu kódování má Grok 4.5 hodnotu 72,4 proti 71,8 u Qwen3.8 Max, jde o těsný odstup. V hloubkovém benchmarku SciCode, který měří programování vědeckých algoritmů, má Grok 4.5 náskok 54,1 proti 52,9, což je jeho největší zaznamenaný náskok.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 11. srpna 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.