Srovnáváme dva špičkové modely, Claude Opus 5 od Anthropic a Kimi K3 od Kimi, podle aktuálních benchmarků z července 2026. Zaměřujeme se na souhrnné indexy inteligence a kódování, hloubkové testy pro vědu, dlouhé kontexty a práci s kódem, stejně jako na cenu a rychlost. Data pocházejí z oficiálních měření tvůrců.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Souhrnné výkonnostní indexy a cena
Claude Opus 5 dosahuje v souhrnném indexu inteligence hodnoty 60,7 a v kódování 78. Kimi K3 zaostává s 57,1 v inteligenci, ale v kódování je s 76,2 těsně za ním. Cena za milion tokenů je u Claude Opus 5 10 USD, zatímco Kimi K3 stojí 6 USD. Rychlost zpracování je u Claude Opus 5 61,4 tokenů za sekundu, u Kimi K3 pak 32,9 tokenů za sekundu.
V časové odezvě (TTFT) je Claude Opus 5 pomalejší s 32,53 sekundami, zatímco Kimi K3 dosahuje 5,48 sekundy. Předpočítaný rozdíl v inteligenci činí 3,6 bodu ve prospěch Claude Opus 5.
Hloubkové benchmarky a jejich reálný význam
V expertních otázkách napříč obory (HLE) vede Claude Opus 5 s 52,6 %, zatímco Kimi K3 dosahuje 44,3 %. Tento test měří schopnost odpovídat na komplexní otázky z různých vědních disciplín, což je klíčové pro vědu a výzkum.
V vědeckých otázkách doktorandské úrovně (GPQA Diamond) je Kimi K3 těsně před Claude Opus 5: 93,5 % versus 93,2 %. V programování vědeckých algoritmů (SciCode) zvítězil Kimi K3 s 58,7 % oproti 55,7 % u Claude Opus 5. V porozumění dlouhému kontextu (LCR) je Kimi K3 opět lepší s 74,7 % proti 70 % u Claude Opus 5.
Co z toho plyne pro české firmy
Pro náročné vědecké úlohy a komplexní otázky je Claude Opus 5 silnější, zvláště v HLE, kde má náskok 8,3 procentního bodu. Pokud však jde o práci s dlouhými dokumenty nebo vědeckým kódem, Kimi K3 nabízí srovnatelný nebo lepší výkon za nižší cenu a vyšší rychlost.
Pro autonomní agenty a práci v terminálu může být rozhodující cena a rychlost. Kimi K3 je levnější a rychlejší, což může být pro mnoho aplikací rozhodující. Claude Opus 5 zase exceluje tam, kde je potřeba hluboké porozumění a komplexní úsudek.
Časté dotazy
Který model je lepší pro vědecké úlohy?
Claude Opus 5 vede v expertních otázkách napříč obory (HLE) s 52,6 %, zatímco Kimi K3 dosahuje 44,3 %. V vědeckých otázkách doktorandské úrovně (GPQA Diamond) je však Kimi K3 těsně před Claude Opus 5 s 93,5 % oproti 93,2 %.
Jaký je rozdíl v ceně mezi oběma modely?
Claude Opus 5 stojí 10 USD za milion tokenů, zatímco Kimi K3 6 USD. Předpočítaný poměr cen je 1,7× ve prospěch Kimi K3.
Který model je rychlejší?
Kimi K3 dosahuje rychlosti 32,9 tokenů za sekundu, zatímco Claude Opus 5 61,4 tokenů za sekundu. V časové odezvě (TTFT) je však Kimi K3 výrazně rychlejší s 5,48 sekundami oproti 32,53 sekundám u Claude Opus 5.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 29. července 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.