V srpnu 2026 čelí Anthropic tlaku levnějších čínských modelů a podle agenturních zpráv reaguje cenovou válkou na trhu s AI. Do tohoto prostředí patří i souboj Claude Opus 5 proti Kimi K3 od firmy Kimi. Srovnání staví vedle sebe souhrnné indexy inteligence a kódování, čtveřici hloubkových benchmarků pokrývajících expertní znalosti, vědu, programování a dlouhý kontext, a nakonec cenu a rychlost odpovědi. Cílem je ukázat, kde má který model reálnou výhodu, ne který má vyšší jedno číslo.

Svislé sloupce: souhrnné indexy (inteligence, kódování) modelů Claude Opus 5 a Kimi K3 Souhrnné indexy: inteligence, kódování.

Svislé sloupce: úspěšnost modelů Claude Opus 5 a Kimi K3 v jednotlivých hloubkových benchmarcích Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.

Bodový graf ceny proti inteligenci se zvýrazněnými modely Claude Opus 5 a Kimi K3 Duel v kontextu celého pole: cena (log) vs. Intelligence Index.

Souhrnné indexy ukazují těsný, ne jednoznačný náskok

Souhrnný index inteligence staví Claude Opus 5 na 63,1 bodu, Kimi K3 dosahuje 59,7 bodu · rozdíl mezi oběma modely je předpočítán na 3,4 bodu ve prospěch Anthropicu. V indexu kódování vede Claude Opus 5 s hodnotou 78 proti 76,2 bodu u Kimi K3. Obě čísla tedy staví Claude Opus 5 do role favorita, pokud by se srovnání zastavilo jen u těchto dvou agregátů.

Obraz se mění, jakmile se přejde k jednotlivým benchmarkům. HLE testuje expertní otázky napříč obory a je relevantní pro práci s odbornými dotazy a výzkumnou podporu · tady Claude Opus 5 dosahuje 54,9 procenta proti 46,9 procenta u Kimi K3, což je podle předpočítaného údaje jeho největší náskok, osm procentních bodů. GPQA Diamond měří vědecké otázky doktorandské úrovně a je klíčový pro nasazení ve vědě a výzkumu · tady je pořadí obrácené, Kimi K3 dosahuje 93,5 procenta a Claude Opus 5 93,2 procenta, tedy těsný odstup.

SciCode ověřuje schopnost programovat vědecké algoritmy, což je relevantní pro autonomní agenty pracující s výpočetním kódem · Kimi K3 zde vede s 58,7 procenta proti 55,7 procenta u Claude Opus 5. LCR testuje porozumění dlouhému kontextu, tedy schopnost pracovat s rozsáhlými dokumenty a dlouhými zadáními · Kimi K3 dosahuje 82,7 procenta proti 75,7 procenta u Claude Opus 5, což je jeho největší náskok, sedm procentních bodů.

Rychlost, prodleva a cena mění praxi

Cenový rozdíl je citelný: Claude Opus 5 stojí 10 dolarů za milion tokenů, Kimi K3 pouze 6 dolarů, poměr cen je předpočítán na 1,7×. Pro organizace, které zpracovávají velké objemy textu, se rozdíl v ceně za milion tokenů promítá přímo do provozního rozpočtu bez ohledu na to, který model má vyšší index inteligence.

Rychlost odpovědi se dá číst dvěma způsoby. Claude Opus 5 generuje 46,4 tokenu za sekundu, Kimi K3 36,5 tokenu za sekundu, poměr rychlostí je předpočítán na 1,3× ve prospěch Anthropicu. Jenže doba do prvního tokenu, TTFT, vypráví jiný příběh: Claude Opus 5 čeká 28,53 sekundy, než začne odpovídat, zatímco Kimi K3 pouze 2,75 sekundy. Pro interaktivní nasazení, chatové rozhraní nebo práci v terminálu, kde uživatel čeká na první znak odpovědi, je tento rozdíl patrnější než rozdíl v propustnosti tokenů za sekundu.

Benchmarky jako HLE, GPQA Diamond, SciCode nebo LCR měří výkon na definovaných úlohách, ne chování v reálném provozu. Podle mediálního monitoringu Anthropic nedávno popsal, jak AI agenti mohou mezi sebou soupeřit, spolupracovat nebo se dostat do konfliktu při plnění úkolů · připomínka, že dodržování zadání v multiagentním nasazení se v tabulkách inteligence a kódování nezobrazí a rozhoduje o něm až konkrétní provoz.

Který model pro jaké nasazení

Pro organizace, které potřebují expertní odpovědi napříč obory nebo pracují s výzkumnými dotazy, dává smysl Claude Opus 5 · vede v HLE i v souhrnném indexu inteligence. Naopak firmy, jejichž provoz stojí na zpracování dlouhých dokumentů, smluv nebo rozsáhlé dokumentace, by měly zvážit Kimi K3, který v LCR dosahuje 82,7 procenta proti 75,7 procenta u Claude Opus 5 a je zároveň podle poměru cen 1,7× levnější.

Pro interaktivní nasazení, kde záleží na rychlé první odpovědi · asistenti v reálném čase, práce v terminálu, agentní workflow · hraje roli TTFT: Kimi K3 s 2,75 sekundy reaguje citelně rychleji než Claude Opus 5 s 28,53 sekundy. Volba tedy nemá jednoho vítěze, ale závisí na tom, zda firma upřednostní hloubku expertních odpovědí, cenu, práci s dlouhým kontextem, nebo rychlost první reakce.

Časté dotazy

Který model je rychlejší, Claude Opus 5 nebo Kimi K3?

Podle propustnosti tokenů je rychlejší Claude Opus 5 s 46,4 tokenu za sekundu proti 36,5 tokenu za sekundu u Kimi K3, poměr rychlostí je předpočítán na 1,3násobek. U doby do první odpovědi je to ale obráceně: Kimi K3 má TTFT 2,75 sekundy, Claude Opus 5 celých 28,53 sekundy.

Je Kimi K3 levnější než Claude Opus 5?

Ano, Kimi K3 stojí 6 dolarů za milion tokenů, Claude Opus 5 10 dolarů za milion tokenů. Poměr cen je předpočítán na 1,7násobek ve prospěch Kimi K3. Nižší cena ale neznamená vyšší výkon ve všech metrikách · v HLE i indexu inteligence vede Claude Opus 5.

Který model je lepší pro práci s dlouhými dokumenty?

V benchmarku LCR, který měří porozumění dlouhému kontextu, dosahuje Kimi K3 82,7 procenta, zatímco Claude Opus 5 75,7 procenta. Jde o největší náskok Kimi K3 v celém srovnání, předpočítaný na sedm procentních bodů, takže pro rozsáhlé dokumenty je z dat výhodnější Kimi K3.

ZDROJE DAT A METODIKA

Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 15. srpna 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.