Duel vrcholných modelů Claude Fable 5 od Anthropic a Grok 4.5 od xAI přináší čerstvé benchmarky z července 2026. Srovnáváme souhrnné indexy inteligence a kódování, hloubkové benchmarky pro vědu, kódování a dlouhé dokumenty, a především cenu a rychlost. Data ukazují, kde který model exceluje a kde zaostává, aniž bychom hledali univerzálního vítěze.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Souhrnné indexy a hloubkové benchmarky
V souhrnném indexu inteligence vede Claude Fable 5 s hodnotou 59,9, zatímco Grok 4.5 dosahuje 53,8. V kódování je rozdíl menší: Claude Fable 5 má 76,5, Grok 4.5 pak 72,4.
V hloubkových benchmarcích se Claude Fable 5 prosazuje v expertních otázkách napříč obory (HLE) s 53,3 %, kde Grok 4.5 má 40,3 %. V porozumění dlouhému kontextu (LCR) má Claude Fable 5 70 %, Grok 4.5 67,7 %. Naopak v vědeckých otázkách doktorandské úrovně (GPQA Diamond) je Grok 4.5 těsně před Claude Fable 5: 93,1 % proti 92,6 %. V programování vědeckých algoritmů (SciCode) vede Claude Fable 5 s 60,2 % oproti 54,1 % Grok 4.5.
Cena a rychlost v reálném provozu
Cena za jeden milion tokenů je u Claude Fable 5 20 USD, zatímco Grok 4.5 stojí pouze 3 USD. Rychlost zpracování je u Grok 4.5 výrazně vyšší: 107,6 tokenů za sekundu oproti 60,6 u Claude Fable 5. Doba do první odpovědi (TTFT) je u Grok 4.5 13,03 sekundy, u Claude Fable 5 pak 54,3 sekundy.
Laboratorní benchmarky neodrážejí vždy reálné náklady a výkon. Zatímco Claude Fable 5 exceluje v náročných úlohách, Grok 4.5 nabízí výrazně nižší provozní náklady a vyšší propustnost, což může být rozhodující pro aplikace s vysokým objemem dotazů. Poměr cen a rychlostí tak může v praxi převážit nad drobnými rozdíly v úspěšnosti.
Pro jaké nasazení se který model vyplatí
Claude Fable 5 je vhodný pro úlohy vyžadující hluboké porozumění kontextu a expertní znalosti, jako jsou komplexní analýzy, vědecké úkoly nebo práce s dlouhými dokumenty. Jeho vyšší cena a nižší rychlost se vyplácí tam, kde kvalita převyšuje kvantitu.
Grok 4.5 je naopak ideální pro nasazení s vysokými objemy dotazů, kde jsou rozhodující nízké náklady a rychlost. Pro běžné úlohy, kde stačí solidní výkon bez špičkové přesnosti, může být Grok 4.5 ekonomičtější volbou.
Časté dotazy
Který model je lepší pro vědecké úlohy?
V vědeckých otázkách doktorandské úrovně (GPQA Diamond) vede Grok 4.5 s 93,1 %, těsně před Claude Fable 5 s 92,6 %. V programování vědeckých algoritmů (SciCode) je pak Claude Fable 5 s 60,2 % úspěšnější než Grok 4.5 s 54,1 %.
Jaký je rozdíl v ceně mezi oběma modely?
Cena za jeden milion tokenů je u Claude Fable 5 20 USD, zatímco Grok 4.5 stojí 3 USD. Poměr cen je předpočítán na 6,7× ve prospěch Grok 4.5.
Který model je rychlejší?
Grok 4.5 dosahuje rychlosti 107,6 tokenů za sekundu, zatímco Claude Fable 5 má 60,6 tokenů za sekundu. Doba do první odpovědi je u Grok 4.5 13,03 sekundy, u Claude Fable 5 pak 54,3 sekundy.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 10. července 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.