AMD akvizuje startup Taalas pro specializované AI inference čipy
AMD oznámila nákup torontského startupu Taalas, který vyvíjí čipy s váhami modelů přímo vytesanými v siliku pro extrémně rychlé inference.
Společnost AMD potvrdila akvizici kanadského startupu Taalas, specializovaného na vývoj modelově specifických integrovaných obvodů (MSIC) pro AI inference. Transakci oznámila 6. srpna 2026 po uzavření burzy; finanční podmínky nebyly uveřejněny. Podle The Register jde o plnohodnotnou akvizici, nikoliv pouhé acquihire. Taalas, založený v roce 2023 v Torontu, se stane součástí AMD a jeho tým bude pracovat na integraci technologie do portfolia Instinct. CEO Lisa Su podle Latent Space podporuje strategii přizpůsobeného hardwaru pro inference, i když dřívější skepticalní názory na vytesané modely existovaly.
Jádrem přístupu Taalas je odlišná filozofie návrhu hardwaru: váhy modelu nejsou ukládány v externí paměti HBM, nýbrž přímo vytesány do silika v oblasti mask-ROM recall fabric. Druhá část čipu tvoří SRAM recall fabric pro KV cache a adaptery jemného ladění (např. LoRA). První testovací čip HC1 vyrobený v 6nm procesu TSMC dokázal v únoru 2026 obsluhovat model Llama 3.1 8B rychlostí 16 960 tokenů za sekundu · podle interních měření o 48× rychleji než GPU Nvidie a 8,5× rychleji než akcelerátory Cerebras. Druhá generace HC2, očekávaná v létě 2026, má cílit na modely o velikosti 20 miliard parametrů; pro trilionový model by podle výpočtů startupu stačilo padesát takových akcelerátorů propojených pipeline paralelismem.
AMD zamýšlí Taalasovy čipy párovat se svými rackovými platformami Helios postavenými na GPU Instinct. V takové disagregované architektuře by GPU zajišťovaly výpočetně náročné zpracování promptu (prefill), zatímco generace tokenů by byla odložena na specializované akcelerátory Taalas. Alternativně by mohlo dojít k „tick-tock“ kadenci: zákazníci by modely nejprve validovali na Instinctu a po stabilizaci přecházeli na Taalas pro produkční nasazení. SVP pro AI Vamsi Boppana uvedl, že AMD buduje full-stack platformu dávající zákazníkům flexibilitu volby výpočetního řešení pro každou AI úlohu. The Register uvádí, že tento krok je rámován podobně jako licenční dohoda Nvidie s Groq z prosince 2025 v hodnotě 20 miliard dolarů · obě společnosti cílí na prémiové inferenční služby pro AI agenty jako asistenty kódu.
Technologie přináší zásadní kompromis: jakmile je čip vyroben, je vázán na konkrétní model. Jakákoli změna přesahující rámec LoRA adapterů vyžaduje nový tape-out, což je náročné na čas i finance. V prostředí, kde se nové modely objevují měsíčně, to omezuje využitelnost k případům s dlouhodobě stabilní architekturou modelu · typicky specializovaným agentům, asistentům kódu nebo vertikálním aplikacím s předvídatelným životním cyklem. The Register upozorňuje, že zákazníci budou muset být velmi jistí svou volbou modelu, aby z Taalasovy technologie profitovali.
Co to znamená: Pro firmy implementující AI znamená akvizice posun k hybridním inferenčním clusterům, kde se flexibilita GPU doplňuje extrémní efektivitou specializovaného silika pro stabilní modely. Audit nasazení by měl zohlednit životní cyklus modelu: u často se měnících architektur zůstane GPU ekonomičtější, u ustálených úloh (např. specializované agenty, embeddingové služby) může Taalasova cesta snížit TCO o řád. AMD s Instinctem a Taalasem pokrývá obě krajnosti spektru.
Zdroje:
