V září 2026 stojí proti sobě dva vlajkové modely: Claude Fable 5.1 od Anthropicu a Muse Spark 1.3 od Mety. Oba se pohybují na špičce, ale míří na jiné nasazení. Toto srovnání vychází z oficiálních indexů inteligence a kódování, dále z hloubkových benchmarků HLE, GPQA Diamond, SciCode a LCR, a nakonec z ceny za milion tokenů a rychlosti odezvy. Data ukazují zřetelnou dělící linii mezi výkonem a hospodárností.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Kdo vede v číslech a kde
Claude Fable 5.1 dosahuje indexu inteligence 53,4, zatímco Muse Spark 1.3 má 48,2. Předpočítaný rozdíl činí 5,2 bodu. V kódování vede Claude Fable 5.1 s hodnotou 81,6 proti 75,8 u Muse Spark 1.3. V hloubkových testech si Claude Fable 5.1 udržuje náskok ve všech čtyřech oblastech.
Největší rozdíl je v benchmarku HLE, kde Claude Fable 5.1 dosahuje 59,1 a Muse Spark 1.3 48,7, což představuje předpočítaný náskok 10,4 procentního bodu. Tento test měří expertní otázky napříč obory, takže je relevantní pro vědu a výzkum. V GPQA Diamond, tedy vědeckých otázkách doktorandské úrovně, jsou hodnoty téměř vyrovnané: 93,7 proti 93,5.
Co čísla znamenají v praxi
Vysoké skóre v HLE a GPQA Diamond naznačuje, že Claude Fable 5.1 zvládá náročné expertní dotazy o něco spolehlivěji než Muse Spark 1.3. Pro vědecké týmy, které potřebují odpovědi na úrovni doktorandského výzkumu, je rozdíl v HLE podstatný. Naopak v GPQA Diamond jsou oba modely prakticky nerozeznatelné, takže zde rozhodují jiné faktory, jako cena nebo rychlost.
Muse Spark 1.3 vyniká rychlostí: 385,7 tokenů za sekundu proti 67,1 u Claude Fable 5.1, což je předpočítaný poměr 5,7×. Čas do prvního tokenu má Muse Spark 1.3 26,45 sekundy, Claude Fable 5.1 130,04 sekundy. Pro autonomní agenty nebo práci v terminálu, kde záleží na každé odezvě, je tento rozdíl zásadní. Cena 2 dolary za milion tokenů u Muse Spark 1.3 proti 20 dolarům u Claude Fable 5.1, tedy předpočítaný poměr 10×, dělá z Metina modelu výrazně dostupnější volbu.
Jak vybrat podle nasazení
Pro české firmy platí jednoduché pravidlo. Pokud řešíte vědecké výpočty, dlouhé dokumenty nebo úlohy, kde je klíčová přesnost a porozumění kontextu, sáhněte po Claude Fable 5.1. Jeho výsledky v LCR 85,3 proti 83 u Muse Spark 1.3 a v SciCode 63,1 proti 58,8 ukazují, že si poradí s náročnějšími zadáními. Počítejte ale s vyšší cenou a pomalejší odezvou.
Pokud nasazujete model ve velkém objemu, třeba pro zákaznickou podporu nebo automatizaci rutinních úkolů, je Muse Spark 1.3 ekonomičtější volbou. Rychlost 385,7 tokenů za sekundu a cena 2 dolary za milion tokenů umožňují provozovat více dotazů za stejné náklady. Pro autonomní agenty, kde záleží na nízké latenci, je tento model vhodnější. Žádný univerzální vítěz neexistuje, rozhoduje konkrétní úloha.
Časté dotazy
Který model je lepší pro vědecké výzkumné úlohy?
Pro vědecké výzkumné úlohy vychází lépe Claude Fable 5.1. V benchmarku HLE, který měří expertní otázky napříč obory, dosahuje 59,1 proti 48,7 u Muse Spark 1.3. V GPQA Diamond, tedy vědeckých otázkách doktorandské úrovně, jsou hodnoty téměř vyrovnané: 93,7 proti 93,5. Rozhodující je proto především HLE, kde má Claude Fable 5.1 předpočítaný náskok 10,4 procentního bodu.
Je Muse Spark 1.3 dostatečně rychlý pro autonomní agenty?
Ano, Muse Spark 1.3 je pro autonomní agenty výrazně rychlejší volbou. Dosahuje 385,7 tokenů za sekundu, zatímco Claude Fable 5.1 pouze 67,1, což představuje předpočítaný poměr 5,7×. Čas do prvního tokenu má Muse Spark 1.3 26,45 sekundy proti 130,04 sekundy u Claude Fable 5.1. Pro agenty, kteří potřebují rychlé reakce, je tento rozdíl zásadní.
Který model je levnější na provoz?
Muse Spark 1.3 je výrazně levnější. Cena za milion tokenů činí 2 dolary, zatímco u Claude Fable 5.1 je to 20 dolarů. Předpočítaný poměr cen je 10×. Pokud provozujete velké objemy dotazů, Muse Spark 1.3 výrazně snižuje náklady. Claude Fable 5.1 se vyplatí spíše u náročných úloh, kde je klíčová přesnost a vyšší skóre v expertních testech.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 13. září 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.