Anthropic a Alibaba vydaly v posledních měsících nové vlajkové modely Claude Opus 5 a Qwen3.8 Max a oba si nárokují přední místo mezi jazykovými modely. Srovnání vychází z tabulky benchmarkových dat, která zahrnuje souhrnné indexy inteligence a kódování, čtyři hloubkové testy zaměřené na vědu, dlouhý kontext a programování, a provozní parametry · cenu, rychlost generování a dobu do prvního tokenu.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Kde Claude Opus 5 skutečně vede
V souhrnném indexu inteligence dosahuje Claude Opus 5 hodnoty 63,1, zatímco Qwen3.8 Max 58,1 · rozdíl činí podle předpočítané hodnoty pět bodů. Podobný obrázek nabízí index kódování, kde Claude Opus 5 skóruje 78 a Qwen3.8 Max 71,8. Anthropic tedy vede v obou souhrnných ukazatelích, otázkou zůstává, jak velký je rozdíl v jednotlivých hloubkových testech, kde se souhrnné indexy rozpadají na konkrétní dovednosti.
U benchmarku HLE, který testuje expertní otázky napříč obory a je relevantní především pro vědu a výzkum, dosahuje Claude Opus 5 skóre 54,9 procenta oproti 43 procentům u Qwen3.8 Max · jde podle předpočítané hodnoty o největší náskok Claude Opus 5 v celém srovnání, 11,9 procentního bodu. U GPQA Diamond, který měří vědecké otázky doktorandské úrovně a je stejně tak doménou výzkumu, je odstup mnohem těsnější: 93,2 procenta proti 92,7 procenta.
SciCode, benchmark zaměřený na programování vědeckých algoritmů a relevantní pro autonomní agenty a práci v terminálu, ukazuje Claude Opus 5 na 55,7 procenta a Qwen3.8 Max na 52,9 procenta. LCR, který testuje porozumění dlouhému kontextu a je klíčový pro práci s rozsáhlými dokumenty, vychází 75,7 procenta pro Claude Opus 5 a 74,3 procenta pro Qwen3.8 Max · opět těsný odstup, podobně jako u GPQA Diamond.
Cena, rychlost a co benchmark nezachytí
Cenový rozdíl je v tabulce nejvýraznější položkou: Claude Opus 5 stojí 10 dolarů za milion tokenů, Qwen3.8 Max jen 3 dolary, což odpovídá předpočítanému poměru cen 3,3 násobku. Rychlost generování je naopak téměř vyrovnaná · 46,4 tokenu za sekundu u Claude Opus 5 proti 43,3 tokenu za sekundu u Qwen3.8 Max, tedy poměr rychlostí jen 1,1 násobku podle předpočítané hodnoty. Zásadní rozdíl se ale skrývá v době do prvního tokenu: Claude Opus 5 potřebuje 28,53 sekundy, Qwen3.8 Max jen 1,81 sekundy. Pro interaktivní použití, kde uživatel čeká na první odpověď, je to citelně jiná zkušenost, než napovídá blízkost čísel u tokenů za sekundu.
Vysoké skóre v HLE nebo GPQA Diamond neznamená, že model stejně spolehlivě funguje v delším agentním řetězci úkolů · testy měří jednorázové odpovědi na statické otázky, ne dodržování zadání napříč desítkami kroků. Podle mediálního monitoringu přitom Anthropic sám zkoumal chování více AI agentů nasazených na stejný úkol a zjistil, že mezi sebou mohou soupeřit, spolupracovat i vytvářet neočekávané koalice · což naznačuje, že dnešní bezpečnostní testy ani hloubkové benchmarky nemusí plně zachytit rizika víceagentních nasazení, o kterých SciCode a podobné testy ambiciózně mluví jen nepřímo. Podle agenturních zpráv navíc probíhá mezi americkými a čínskými poskytovateli cenová válka, což může vysvětlovat, proč je rozdíl v ceně mezi Claude Opus 5 a Qwen3.8 Max tak výrazný už dnes.
Který model zvolit pro jaké nasazení
Pro výzkumné týmy, akademická pracoviště nebo firmy řešící expertní odborné dotazy dává smysl Claude Opus 5 · náskok v HLE i vyšší index inteligence a kódování jsou tam, kde na přesnosti nejvíc záleží. U GPQA Diamond a LCR je ale rozdíl natolik těsný, že pro úlohy postavené na vědeckých otázkách doktorandské úrovně nebo na práci s dlouhými dokumenty nemusí vyšší cena Claude Opus 5 přinést úměrně vyšší užitek.
Naopak pro provozy s vysokým objemem dotazů, kde se počítá cena za milion tokenů a rychlá odezva prvního tokenu · typicky nasazení v terminálu nebo interaktivní agentní pipeline · vychází Qwen3.8 Max jako nákladově efektivnější volba díky ceně 3 dolary za milion tokenů a době do prvního tokenu 1,81 sekundy. České firmy by měly volbu vázat na konkrétní úlohu, ne na souhrnný index inteligence samotný, protože ten skrývá rozdílně velké mezery v jednotlivých dovednostech.
Časté dotazy
Je Claude Opus 5 rychlejší než Qwen3.8 Max?
V počtu tokenů za sekundu ano, ale jen těsně · 46,4 proti 43,3, poměr rychlostí je podle předpočítané hodnoty 1,1 násobku. V době do prvního tokenu je ale rozdíl opačný a výrazný: Claude Opus 5 potřebuje 28,53 sekundy, Qwen3.8 Max jen 1,81 sekundy, takže pro rychlou odezvu je Qwen3.8 Max znatelně svižnější.
O kolik je Claude Opus 5 dražší než Qwen3.8 Max?
Claude Opus 5 stojí 10 dolarů za milion tokenů, Qwen3.8 Max 3 dolary za milion tokenů. Podle předpočítané hodnoty odpovídá tento rozdíl poměru cen 3,3 násobku · Claude Opus 5 je tedy řádově dražší volba, což se projeví hlavně u vysokoobjemového nasazení.
Ve kterém benchmarku vede Claude Opus 5 nejvíc?
Nejvýraznější náskok má Claude Opus 5 v benchmarku HLE, který testuje expertní otázky napříč obory: dosahuje 54,9 procenta oproti 43 procentům u Qwen3.8 Max. Podle předpočítané hodnoty jde o rozdíl 11,9 procentního bodu, tedy největší mezeru ze všech čtyř hloubkových testů v tomto srovnání.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 15. srpna 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.