Srovnáváme dvanáct modelů pro generování obrázků podle hodnocení Elo, které vzniká z lidských preferencí v říjnu 2026. Zajímá nás líbivost výstupů, nikoli přesné plnění zadání. Takové srovnání je nyní důležité, protože nabídka modelů od tvůrců OpenAI, Microsoft AI, Google, Meta a xAI se rychle mění a komerční výběr potřebuje střízlivý pohled na rozdíly mezi špičkou a středem pole.

Sloupcový graf Elo hodnocení nejlepších text-to-image modelů Elo z lidských preferencí.

Špička vede a střed je vyrovnaný

Na čele stojí GPT Image 2.5 Sunburst s hodnotou 1 197 a v těsném odstupu následuje GPT Image 2.5 Flare s hodnotou 1 191. Dále je v pořadí GPT Image 2 s hodnotou 1 172, za ním Grok Imagine Image 2.0 s hodnotou 1 155 a MAI-Image-2.6 s hodnotou 1 151. Rozestup špičky působí jasně, ale bez vyčíslení jde spíše o odstupňované pásmo než o propast.

Střed pole je hustý a pořadí řádků ukazuje vyrovnané sousedství. Nano Banana 2 má hodnotu 1 125, Muse Image má hodnotu 1 115, GPT Image 1.5 má hodnotu 1 107 a MAI-Image-2.6-Flash má hodnotu 1 106. Následují MAI-Image-2.5 s hodnotou 1 104, Nano Banana Pro s hodnotou 1 102 a MAI-Image-2.5-Pro s hodnotou 1 100. Překvapivá je síla tvůrce OpenAI nahoře a početní převaha tvůrce Microsoft AI ve středu a závěru.

Líbivost není věrnost zadání

Hodnocení Elo z lidských preferencí říká, který obrázek se líbil více, nikoli který přesněji splnil textové zadání, styl, kompozici či pravidla značky. Model s hodnotou 1 197 tedy není automaticky přesnější než model s hodnotou 1 125, je pouze častěji vítězem chuťového souboje. Pro praxi to znamená opatrnost, protože líbivý výstup může nést chybnou stavbu, text, ruce nebo firemní identitu.

Laboratorní souboj se liší od provozu také tím, že hodnotitelé vidí jeden obrázek vedle druhého a volí rychle. V provozu rozhoduje opakovatelnost, stálost postav a stylu napříč sérií, práce s poměrem stran a dodržení omezení. Těsné sousedství ve středu, například hodnoty 1 107, 1 106 a 1 104, nelze číst jako jistý rozdíl kvality pro každou zakázku. Věřit lze pořadí řádků, nikoli představě, že vyšší Elo samo zaručí obchodní výsledek.

Jak vybírat pro českou praxi

České firmy a organizace by měly žebříček použít jako užší výběr, nikoli jako konečný rozsudek. Do vlastního testu má smysl vzít špičku kolem hodnot 1 197, 1 191 a 1 172 a vedle ní několik zástupců středu, například s hodnotami 1 125, 1 115 a 1 104. Každý model nechte kreslit stejná obchodní zadání a hodnoťte věrnost zadání, použitelnost bez úprav a stálost výstupu.

Při výběru sledujte tvůrce a provozní podmínky vedle Elo, protože cena, rychlost, práva k užití a zpracování dat rozhodují stejně jako líbivost. Model s hodnotou 1 102 nebo 1 100 může v úzkém úkolu obstát lépe než lídr s hodnotou 1 197, pokud drží styl a méně chybuje. Vítězem je ten, který projde vaším testem, nikoli jen čelem žebříčku.

Časté dotazy

Který model generování obrázků má nejvyšší Elo?

Nejvýše je v pořadí GPT Image 2.5 Sunburst s hodnotou 1 197, za ním je GPT Image 2.5 Flare s hodnotou 1 191 a dále GPT Image 2 s hodnotou 1 172. Pořadí přebíráme z řádků srovnání, nikoli z vlastního přepočtu. Vyšší Elo znamená větší líbivost v lidském hlasování, nikoli automaticky větší věrnost zadání v obchodním provozu.

Jak si stojí Nano Banana a Muse Image v lidských preferencích?

Nano Banana 2 má hodnotu 1 125 a v pořadí řádků je před Muse Image s hodnotou 1 115. Rozdíl slovně působí jako umírněný odstup ve středu pole. Dále je v pořadí GPT Image 1.5 s hodnotou 1 107. Pro volbu je důležitější vlastní test na firemních zadáních než samotné sousedství v žebříčku líbivosti.

Vyplatí se modely ze středu žebříčku pro firemní použití?

Ano, střed pole může být věcně zajímavý, protože je vyrovnaný. MAI-Image-2.6-Flash má hodnotu 1 106, MAI-Image-2.5 má hodnotu 1 104, Nano Banana Pro má hodnotu 1 102 a MAI-Image-2.5-Pro má hodnotu 1 100. V provozu rozhoduje věrnost zadání, stálost stylu a náklady na úpravy, proto vždy porovnejte několik modelů na stejných úkolech.

ZDROJE DAT A METODIKA

Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 5. října 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.