Srovnání dvanácti modelů generování obrázků podle Elo skóre z lidských preferencí za srpen 2026 ukazuje pořadí líbivosti výstupů. Data pocházejí z benchmarku, kde hodnocí porovnávali páry obrázků bez znalosti autora. Tabulka obsahuje modely od OpenAI, Reve, Microsoft AI, Google, HiDream, Bytedance, NVIDIA a Recraft. Měření odráží subjektivní vkus, ne technickou přesnost dodržení promptu, což je klíčové pro výběr v komerční praxi.
Elo z lidských preferencí.
Co data ukazují o pořadí modelů
Ve vrcholu žebříčku stojí GPT Image 2 s Elo 1 339, těsně před nímž se umístil Reve 2.1 s 1 299. Třetí místo obsadil MAI-Image-2.5 s 1 270. Střed pole tvoří skupina tří modelů s velmi blízkými hodnotami: Nano Banana 2 Lite a GPT Image 1.5 sdílejí skóre 1 263, za nimi následuje Nano Banana 2 s 1 262. HiDream-O1-Image-1.5 dosáhl 1 245, Seedream 5.0 Pro 1 240. Dolní třetinu otevře Nano Banana Pro s 1 225, Cosmos3-Super-Text2Image s 1 219, MAI-Image-2.5-Flash s 1 208 a Recraft V4.1 Utility s 1 205. Překvapivě se u Googlu ukazuje, že verze Lite a základní verze Nano Banana 2 překonávají Pro variantu.
Kritická interpretace Elo v praxi
Elo skóre vyjadřuje pravděpodobnost, že lidé preferují výstup jednoho modelu před druhým, ne míru shody s textovým zadáním. Model s vyšším Elo může generovat esteticky příjemnější obrázky, které ovšem ignorují klíčové detaily promptu. Rozdíly v řádu desítek bodů, například mezi 1 339 a 1 299, signalizují jasnou preferenci ve srovnávacích boji, ale neříkají nic o konzistenci napříč různými styly ani o dodržování specifických kompozic. Pro komerční použití je rizikové spoléhat se jen na toto pořadí bez vlastních testů na konkrétních typech zadání, protože benchmarková sada nemusí pokrývat specializované domény jako technická ilustrace nebo brandová grafika.
Co z toho plyne pro firmy
Pro české organizace platí, že modely na vrcholu žebříčku jako GPT Image 2 nebo Reve 2.1 nabízejí největší šanci na vizuálně atraktivní výsledky pro marketingové a prezentací účely. Pokud je prioritou nízká latence nebo náklady, modely označené jako Flash, Lite nebo Utility varianty v dolní polovině tabulky mohou být přiměřeným kompromisem. Výběr by měl reflektovat, zda jde o generování hero obrázků, kde rozhoduje první dojem, nebo o sériovou produkci, kde dominuje přesnost a opakovatelnost.
Časté dotazy
Který model generování obrázků má nejvyšší Elo skóre v srpnu 2026?
Nejvyšší Elo 1 339 dosáhl GPT Image 2 od OpenAI. Na druhém místě je Reve 2.1 s 1 299 a třetí MAI-Image-2.5 s 1 270. Skóre odráží výsledek lidských preferencí v párových srovnáních, ne technickou kvalitu ani přesnost dodržení zadání.
Co znamená rozdíl v Elo mezi modelem GPT Image 2 a modelem Recraft V4.1 Utility?
Rozdíl přesahuje stovku bodů, což v Elo systému indikuje silnou preferenci hodnocích k výstupům GPT Image 2. Recraft V4.1 Utility se umístil na poslední místo s 1 205. V praxi to neznamená, že Recraft neprodukuje použitelné výsledky, ale že v přímém srovnání lidé častěji vyberou obrázek od OpenAI.
Jsou modely Nano Banana 2 Lite a GPT Image 1.5 v žebříčku rovnocenné?
Obě modely dosáhly shodného Elo 1 263 a sdílejí čtvrté a páté místo. Nano Banana 2 Lite pochází od Google, GPT Image 1.5 od OpenAI. Identické skóre naznačuje srovnatelnou líbivost ve srovnávacích testech, ale neimplikuje shodu ve stylu, rychlosti ani v dodržování promptu.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 4. srpna 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.