Tabulka sleduje osm modelů Meta od prosince 2024 do září 2026. Index inteligence vzrostl z 7,7 u Llama 3.3 Instruct 70B na 48,2 u Muse Spark 1.3, což podle PŘEDPOČÍTÁNO představuje nárůst o 40,5 bodu v rozpětí 21 měsíců. Průměrný odstup vydání činí tři měsíce. Data zachycují přechod od Llama řady k agentním modelům Muse, souběžně s uvedením osobního agenta Muse a mediálními zprávami o reklamách zneužívajících děti.
Generace modelů Meta v čase; šedě celé pole.
Index inteligence: od Llama k Muse
První tři řádky ukazují nestálý vývoj v Llama generaci. Llama 3.3 Instruct 70B dosáhl indexu 7,7, jeho následovník Llama 4 Scout klesl na 6,5, zatímco souběžně vydaný Llama 4 Maverick doskočil na 9,3. Toto rozdílné chování dvou modelů stejné generace naznačuje, že velikost nebo architektura sama o sobě nezaručuje pokrok.
Přelom nastal s rodinou Muse. Muse Spark z dubna 2026 skočil na 31,3, což přesahuje předchozí maximum řádově. Následné aktualizace Spark 1.1, 1.2 a 1.3 posunuly index na 34,3, 39,8 a 48,2 v rychlé kadenci tří měsíců. Mezi nimi se vkládá Muse Glimmer s 18,1, což signalizuje odlišnou optimalizační větev.
Co benchmarky neodhalí o reálném nasazení
Index inteligence měří laboratorní výkon, ne spolehlivost v produkci. Rychlá sekvence Spark 1.1 až 1.3 s nárůstem o body za tři měsíce může odrážet optimalizaci na konkrétní testy spíše než robustní zlepšení všeobecných schopností. Muse Glimmer s 18,1 bodů zaostává za hlavní linií, což naznačuje kompromisy při specializaci.
Podle mediálního monitoringu Meta nabízí slevu za sdílení uživatelských dat pro trénink Muse Spark, což zpochybňuje nezávislost benchmarků na reálných datech. Ars Technica a Wired v září 2026 popsaly stovky reklam zneužívajících děti, které Meta neodstranila, a legislativní šetření. Tyto události nejsou v indexu zachyceny, ovlivňují ale důvěru v nasazení agentů s přístupem k platebním systémům a zdravotnictví.
Volba modelu pro české organizace
Pro úlohy vyžadující maximální index je Muse Spark 1.3 s 48,2 jasnou volbou, avšak jeho agentní povaha vyžaduje důvěru v dodavatele. Organizace s přísnými požadavky na bezpečnost dat by měly zvážet, zda výhoda o 40,5 bodů nad Llama 3.3 Instruct 70B převažuje nad riziky popsánými v mediálním monitoringu.
Když je prioritou stabilita před vrcholovým skóre, Llama 4 Maverick s 9,3 nabízí osvědčenější architekturu bez agentních rozhraní. Rychlá kadence tří měsíců mezi verzemi Muse znamená, že jakýkoli vybraný model může být za krátko zastaralý, což tlačí k flexibilním smlouvám a kontinuálnímu testování.
Časté dotazy
Jak rychle roste index inteligence modelů Meta?
Index vzrostl z 7,7 na 48,2 za 21 měsíců, což je nárůst o 40,5 bodu podle PŘEDPOČÍTÁNO. Průměrný odstup vydání činí tři měsíce. Největší skok nastal při přechodu k Muse Spark, který dosáhl 31,3 bodů oproti 9,3 Llama 4 Maverick.
Proč Muse Glimmer má nižší index než Spark řada?
Muse Glimmer dosáhl 18,1 bodů, což je méně než Spark 1.2 s 39,8 a Spark 1.3 s 48,2. Tabulka ho řadí mezi Spark 1.2 a 1.3, ale jeho skóre odpovídá dřívějším generacím, což naznačuje jiný optimalizační cíl nebo menší model.
Jak bezpečnostní incidenty ovlivňují nasazení Muse agentů?
Podle mediálního monitoringu Wired a Ars Technica z září 2026 Meta neodstranila stovky reklam zneužívajících děti a legislativní orgány zahájily šetření. Agent Muse vyžaduje přístup k e-mailům, kalendářům, platebním systémům a zdravotnictví, což zvyšuje riziko při nedůvěře k platformě.
ZDROJE DAT A METODIKA
Všechna čísla v tomto srovnání pocházejí z uvedených zdrojů k datu 9. září 2026. Grafy generuje institut CIAD přímo ze zdrojových dat; textová analýza čísla nikdy nedopočítává ani neodhaduje.