Streamovací platforma Twitch, kterou vlastní Amazon, zavedla v nastavení kanálu novou volbu nazvanou „Training for Generative AI“. Streamerům umožňuje odmítnout, aby byl jejich obsah dále využíván k trénování generativních AI modelů Amazonu. Podle aktualizované podpůrné stránky Twitche se bez tohoto kroku k trénování mohou používat živé přenosy, videa na vyžádání (VOD), klipy, zvýrazněné momenty, text, obrázky i zprávy v chatu daného kanálu.
Nastavení je ovšem ve výchozím stavu zapnuté, takže uživatelé musí odhlášení aktivně zvolit na stránce www.twitch.tv/settings/security. Šéf produktu Twitche Mike Minton tento krok během živého vysílání věnovaného novinkám vysvětlil bez okolků: „Kdyby to bylo dobrovolné, nikdo by se nepřihlásil. To je upřímně odpověď. Takže to bude ve výchozím stavu zapnuté,“ uvedl podle serveru The Register.
Jde o pokračování praxe, která podle serverů Ars Technica a The Register funguje již delší dobu. Podle Ars Technica Minton, tehdy hlavní ředitel pro monetizaci Twitche, na akci pořádané publikací The Information v roce 2024 potvrdil, že Amazon data z Twitche k trénování AI modelů skutečně využívá. Novinkou tedy není samotné využívání obsahu, ale to, že uživatelé nyní mají konkrétní nástroj, jak trénování do budoucna zastavit.
Twitch upozorňuje, že modely vzniklé z tohoto tréninku mohou sloužit i mimo samotnou platformu, tedy i v dalších částech firmy Amazon. Jako příklad uvádí zvukové záznamy ze streamů, které mohou pomoci zdokonalit modely převodu řeči na text · to by zlepšilo titulky na Twitchi, ale podle vyjádření firmy „i napříč Amazonem“.
Odhlášení má ale svá omezení. Nastavení se váže na konkrétní kanál, takže odhlášení na vlastním kanálu nechrání zprávy, které uživatel napíše v chatu jiného streamera, pokud ten trénování ponechá povolené · o tom rozhoduje majitel daného kanálu. Twitch navíc formuluje změnu jako platnou výhradně do budoucna: odhlášení znamená, že obsah nebude použit pro „budoucí“ zlepšování generativních AI modelů, firma ale neuvádí, že by přepnutí přepínače jakkoliv odstranilo data, která už byla do modelů zapracována dříve.
Podle Ars Technica diskuse mezi uživateli Twitche, včetně příspěvků jen několik dní před oznámením, ukazují na nedostatečnou informovanost a nejistotu ohledně toho, jak Amazon obsah z platformy skutečně využívá. Redakce Ars Technica i The Register zaslaly Amazonu dotazy, jak dlouho firma obsah z Twitche k trénování využívá, které konkrétní modely na něm vznikly a zda má odhlášení jakýkoliv vliv na už použitá data; odpovědi firmy zatím zveřejněny nebyly.
Důvody, proč by streameři mohli chtít svůj obsah z trénování vyloučit, sahají od absence finančního přínosu přes obavu, že by jim AI mohla konkurovat, až po obecnou nedůvěru vůči Amazonu jako celku. Jiní uživatelé naopak mohou být s využitím svého obsahu pro vývoj AI spokojeni. Nová volba jim v obou případech dává formálně větší kontrolu, výchozí zapnutí funkce spolu s omezenou transparentností ale k důvěře uživatelů příliš nepřispívá.
Co to znamená: Firmy, které využívají platformy s uživatelsky generovaným obsahem, by si měly ověřit výchozí nastavení sdílení dat pro trénování AI a promítnout je do interních zásad ochrany dat a auditu dodavatelských řetězců. Případ ukazuje, že mechanismy odhlášení nemusí pokrývat data už zapracovaná do modelů ani obsah vznikající mimo vlastní účet, což je třeba zohlednit při hodnocení rizik spojených s používáním generativních AI služeb velkých technologických firem.
Zdroje: