Společnost Meta v pondělí představila model Muse Glimmer, svůj první model s otevřenými váhami za více než rok. Jde o 30miliardový jazykový model, který má podle Ars Technica ve výchozím nastavení kontextové okno 128 000 tokenů a vznikl destilací z většího proprietárního modelu Muse Spark. Firma zároveň slíbila, že v následujících týdnech otevře i váhy silnější verze Muse Spark 1.2.

Muse Glimmer vychází pod licencí Apache 2.0, tedy velmi permisivní licencí, která firmám i jednotlivcům umožňuje model volně stahovat, upravovat a nasazovat. Na rozdíl od cloudových služeb má běžet přímo na uživatelských zařízeních · Meta jej staví jako lokálního asistenta pro agentní úlohy, kódovací pomocníky a multimodální volání funkcí. Podle Forbes.cz má model sloužit i jako osobní asistent bez nutnosti připojení k internetu, který by spravoval kalendář, psal zprávy nebo třídil soubory, přičemž data by zůstávala u uživatele. Podporu modelu už oznámily platformy Llama.cpp, Ollama a Unsloth.

Podle Ars Technica vydání navazuje na turbulentní rok Mety v oblasti AI: po neúspěchu modelu Llama 4 firma loni reorganizovala své AI týmy a letos v dubnu přešla k uzavřenému, proprietárnímu modelu Muse Spark, čímž se odklonila od dřívější strategie otevřenosti. V červenci pak s verzí Muse Spark 1.1 spustila svou první placenou službu a 5. srpna vydala Muse Spark 1.2 spolu s terminálovým kódovacím agentem Muse Code, který podle vývojářů nedosahuje kvalit modelů od Anthropic či OpenAI, obstojí ale cenou.

Podle The Register Meta srovnává Muse Glimmer s podobně velkými modely Qwen 3.6-27B od Alibaby a Gemma 4 31B od Googlu; podle zveřejněných výsledků model ve většině scénářů předčí Gemmu a s Qwenem si vyměňuje výsledky. Server ovšem upozorňuje, že srovnání může rychle zastarat, protože Alibaba brzy vydá Qwen 3.8-27B. Na výkonnější čínské modely jako Kimi K3, Qwen 3.8-Max nebo DeepSeek V4-Flash Glimmer nedosahuje.

Podle The Register jsou hardwarové nároky modelu ve srovnání s velkými proprietárními systémy nízké. Ve výchozí přesnosti BF16 se vejde na jednu kartu Nvidia RTX Pro 6000 nebo AMD MI350P, po kvantizaci na 4 bity klesne velikost vah z přibližně 60 GB na necelých 16 GB, což stačí na spotřebitelské grafické karty s 20 až 24 GB paměti, například RTX 3090, 4090 nebo RX 7900 XT/XTX. Model je ale pomalejší než konkurenční systémy typu Qwen 3.6-35B-A3B nebo Gemma 4 26B-A4B, protože na rozdíl od nich při generování každého tokenu využívá všech 30 miliard parametrů místo aktivace jen několika miliard. Na kartě RTX 5090 s přenosovou rychlostí 1,8 TB/s Meta udává výkon 75 až 233 tokenů za sekundu, přičemž vyšších hodnot lze dosáhnout jen s technikou spekulativního dekódování.

Zuckerberg vydání doprovodil rozsáhlým textem o firemní strategii a filozofii vývoje AI, v němž kritizoval společnosti jako OpenAI a Anthropic za prodej přístupu ke svým modelům a varoval před koncentrací moci ve velkých laboratořích. Podle Forbes.cz Zuckerberg uvedl: „Zahraniční laboratoře tu mají několik výhod, protože americké musejí dodržovat řadu dalších omezení ohledně trénovacích dat.“ Otevřenost obhajoval i jako reakci na rostoucí konkurenci čínských otevřených modelů · Hugging Face podle Forbes.cz minulý měsíc uvedl, že se proti kybernetickému útoku bránil právě čínským otevřeným modelem, protože uzavřené systémy mají pro takové použití omezení.

Co to znamená: Pro firmy, které řeší audit a implementaci AI, přináší Muse Glimmer další volně dostupnou alternativu pro lokální nasazení bez závislosti na cloudových API, což může snížit provozní náklady i rizika spojená s únikem dat mimo firemní infrastrukturu. Zároveň je třeba počítat s tím, že model kvůli plnému využití 30 miliard parametrů na token vyžaduje výkonnější hardware a nemusí dosahovat rychlosti ani kvality konkurenčních modelů s efektivnější architekturou, což je nutné zohlednit při plánování nasazení a testování před produkčním provozem.

Zdroje: