Srpen 2026 přináší přímé srovnání dvou aktuálních vlajkových modelů · Claude Opus 5 od Anthropic a GPT-5.6 Sol od OpenAI. Data zahrnují souhrnné indexy inteligence a kódování, cenu za milion tokenů, rychlost generování i čtyři hloubkové benchmarky · HLE, GPQA Diamond, SciCode a LCR · které testují expertní znalosti, vědecké uvažování, programování vědeckých algoritmů a práci s dlouhým kontextem. Srovnání ukazuje, že rozdíly mezi modely jsou v některých metrikách těsné a v jiných výraznější.
Souhrnné indexy: inteligence, kódování.
Hloubkové benchmarky: HLE, GPQA Diamond, SciCode, LCR.
Duel v kontextu celého pole: cena (log) vs. Intelligence Index.
Souhrnné indexy: těsný, ale čitelný náskok
V souhrnném indexu inteligence dosahuje Claude Opus 5 hodnoty 63,1 bodu, GPT-5.6 Sol 60,9 bodu · rozdíl mezi modely činí 2,2 bodu ve prospěch Anthropic. Podobný obrázek je vidět i u kódování: Claude Opus 5 skóruje 78, GPT-5.6 Sol 77,4. V obou souhrnných metrikách tedy vede Claude Opus 5, byť ne o dramatickou vzdálenost.
Cenově je Claude Opus 5 levnější · 10 USD za milion tokenů proti 11,25 USD u GPT-5.6 Sol, poměr cen mezi dražším a levnějším modelem činí 1,1×. Rychlostní metriky ale kreslí odlišný obrázek: GPT-5.6 Sol generuje 63,9 tokenu za sekundu, Claude Opus 5 52,6 tokenu za sekundu, poměr rychlostí činí 1,2× ve prospěch OpenAI. Claude Opus 5 má naopak výrazně kratší čas do prvního tokenu · 30,87 sekundy proti 111,31 sekundy u GPT-5.6 Sol.
Kombinace vysoké propustnosti a dlouhého čekání na první token u GPT-5.6 Sol naznačuje jiný provozní profil než u Claude Opus 5 · jakmile model začne generovat, je rychlejší, ale na start čeká uživatel podstatně déle, což je zásadní pro interaktivní nasazení.
Čtyři hloubkové testy, čtyři různé výsledky
HLE (Humanity’s Last Exam) testuje expertní otázky napříč obory a je relevantní pro nasazení ve vědě a výzkumu, kde se očekává širokospektrální znalost. Zde má Claude Opus 5 jasně navrch · 54,9 % proti 49,5 % u GPT-5.6 Sol, což představuje jeho největší náskok v tomto srovnání, 5,4 procentního bodu. Naopak u GPQA Diamond, testu vědeckých otázek doktorandské úrovně, je přesnější GPT-5.6 Sol s výsledkem 94,1 % proti 93,2 % u Claude Opus 5 · u úzce specializované vědecké expertízy se tedy pořadí obrací.
SciCode měří schopnost programovat vědecké algoritmy a je relevantní pro autonomní agenty pracující na výzkumných úlohách i pro práci v terminálu při automatizaci vědeckých výpočtů. GPT-5.6 Sol zde dosahuje 56,1 % proti 55,7 % u Claude Opus 5 · rozdíl je nejtěsnější ze všech čtyř hloubkových testů. LCR, porozumění dlouhému kontextu, je klíčové pro práci s dlouhými dokumenty a dodržování zadání napříč rozsáhlým vstupem · zde má navrch GPT-5.6 Sol s 77,7 % proti 75,7 % u Claude Opus 5, což je jeho největší náskok v tomto srovnání, 2 procentní body.
Aktuální dění kolem obou firem ukazuje, že benchmarky jsou jen část obrazu. Podle mediálního monitoringu Anthropic v srpnu 2026 nasadil do Claude vodoznaky reagující na požadavky evropské legislativy, což vyvolalo kritiku uživatelů obávajících se odhalení používání AI v práci či ve škole. Na straně OpenAI zase vývojář Simon Willison podle vlastního popisu zadal GPT-5.6 Sol Ultra a nástroji Codex prototypovou úlohu v terminálu · ukázka reálného nasazení v agentní práci s kódem, byť mimo formální benchmark.
Který model zvolit pro jaké nasazení
Pro firmy, které potřebují širokou expertní znalost napříč obory nebo pracují s interaktivními agenty vyžadujícími rychlou první odezvu, dává smysl Claude Opus 5 · kombinuje vyšší index inteligence (63,1), lepší výsledek v HLE (54,9 %), podstatně kratší čas do prvního tokenu (30,87 s) i nižší cenu (10 USD za milion tokenů).
Naopak organizace, které zpracovávají rozsáhlé dokumenty a potřebují spolehlivé porozumění dlouhému kontextu, nebo řeší úzce specializované vědecké otázky doktorandské úrovně, by měly zvážit GPT-5.6 Sol · jeho výsledky v LCR (77,7 %) a GPQA Diamond (94,1 %) jsou vyšší, byť za cenu delšího čekání na první token (111,31 s) a vyšší ceny (11,25 USD za milion tokenů). Volba by tedy měla vycházet z konkrétního typu úlohy, ne z jediného souhrnného čísla.
Časté dotazy
Je Claude Opus 5 levnější než GPT-5.6 Sol?
Ano, Claude Opus 5 stojí 10 USD za milion tokenů, zatímco GPT-5.6 Sol 11,25 USD za milion tokenů. Poměr cen mezi dražším a levnějším modelem činí 1,1×, rozdíl tedy není dramatický. Claude Opus 5 je zároveň rychlejší v čase do prvního tokenu · 30,87 sekundy proti 111,31 sekundy u GPT-5.6 Sol.
Který model je rychlejší při generování textu?
GPT-5.6 Sol generuje 63,9 tokenu za sekundu, Claude Opus 5 52,6 tokenu za sekundu · poměr rychlostí činí 1,2× ve prospěch GPT-5.6 Sol. Claude Opus 5 ale reaguje výrazně rychleji na začátku · čas do prvního tokenu je u něj 30,87 sekundy proti 111,31 sekundy u GPT-5.6 Sol, což je klíčové pro interaktivní použití.
Pro jaké úlohy je lepší GPT-5.6 Sol než Claude Opus 5?
GPT-5.6 Sol dosahuje vyšších výsledků v GPQA Diamond (94,1 % proti 93,2 %), který testuje vědecké otázky doktorandské úrovně, a v LCR (77,7 % proti 75,7 %), testu porozumění dlouhému kontextu · jeho největší náskok v tomto srovnání činí 2 procentní body. Hodí se tedy pro práci s rozsáhlými dokumenty a úzce specializované vědecké dotazy.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 13. srpna 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.