Soud v New Yorku zvažuje, zda má uložit sankce společnosti OpenAI a jejímu partnerovi Microsoftu za údajné zatajování důkazů v autorském sporu, který proti nim vedou The New York Times a další mediální organizace. Žalobci tvrdí, že OpenAI po dobu dvou let lhalo o svých technických možnostech prohledávat anonymizované záznamy konverzací s ChatGPT, čímž ztížilo odhalování případného porušování autorských práv. Podle serveru Ars Technica se tato tvrzení objevila poté, co soud nařídil opětovnou výpověď technického specialisty OpenAI Vincenta Monaka. Ten během depozice v dubnu přiznal, že společnost již dříve taková vyhledávání prováděla.

Podle Ars Technica měla OpenAI před zahájením soudního řízení k dispozici dva velké vzorky logů · jeden s 10 miliony a druhý s 78 miliony anonymizovaných záznamů. Ty sloužily pro interní výzkum, ale nebyly žalobcům nikdy nabídnuty. Žalobci tvrdí, že nedostatek těchto dat prodloužil fázi shromažďování důkazů, zvýšil náklady a znevýhodnil jejich pozici. Server TechCrunch AI uvádí, že OpenAI před podáním žaloby shromáždilo databázi přibližně 78 milionů deidentifikovaných konverzací, aby mohlo interně posoudit míru možného porušování autorských práv.

Podle TechCrunch AI údajně OpenAI implementovalo filtr „Bloom“ v rámci projektu „Project Giraffe“, který měl zaznamenávat a blokovat opakování chráněného obsahu ve výstupech modelu. Tento filtr byl nasazen krátce po podání žaloby jako součást interního úsilí o vytvoření ochranných mechanismů. Žalobci tvrdí, že tyto nástroje a existující vzorky logů by mohly jasně prokázat, zda ChatGPT reprodukuje články The New York Times a dalších médií.

OpenAI ve svém vyjádření obvinění popírá a tvrdí, že žalobci se snaží získat přístup k soukromým uživatelským konverzacím, což by porušovalo zásady ochrany soukromí. Podle společnosti je žádost o rozsáhlé logy „blatným pokusem o narušení soukromí uživatelů“ a součástí „pozdní snahy o oslabení obrany“ v rámci soudního řízení. OpenAI také poukazuje na to, že The New York Times nedávno stáhl některé své nároky, což podle ní naznačuje oslabení případu žalobců.

Podle Ars Technica žalobci argumentují, že OpenAI záměrně neoznámila existenci vzorků logů po celou dobu soudního řízení, čímž záměrně ztížila proces odhalování důkazů. Během depozice měl Monaco údajně říci, že OpenAI „nebylo jednou ani dvakrát“ informováno o existenci těchto vzorků během dvou let. Žalobci dále uvádějí, že OpenAI již prohledalo tyto vzorky kvůli vývoji filtru, který má zabránit opakování chráněného obsahu, a že takové vyhledávání bylo proveditelné a ne „technicky náročné“, jak společnost tvrdila.

OpenAI reaguje, že žalobci zneužívají soudní proces k získání přístupu k soukromým konverzacím, které nemají žádnou souvislost s případem. Podle vyjádření společnosti „budeme i nadále hájit soukromí našich uživatelů a dlouhodobě zavedené principy fair use.“ OpenAI také tvrdí, že kdyby skutečně věřila, že kopírování obsahu je legální, nezatajovala by pravdu o provedených vyhledáváních.

Podle TechCrunch AI žalobci požadují, aby soud zakázal OpenAI použít vzorek 20 milionů logů jako důkaz, protože je podle nich „nepoužitelný“ kvůli rozsáhlému redakčnímu zásahu. Dále žádají, aby soud uznal, že logy by mohly odhalit rozsáhlé opakování obsahu žalobců, a aby OpenAI nesměla argumentovat, že poskytnuté logy neprokazují podstatné porušení autorských práv.

Podle Ars Technica jsou sankce požadovány s odůvodněním, že „zatajení skutečnosti o existenci a schopnosti prohledávat logy odsunulo relevantní důkazy, prodloužilo fázi shromažďování důkazů, zvýšilo náklady a zatížilo soudní proces“. Žalobci tak usilují o finanční postih a omezení možnosti OpenAI použít sporný vzorek logů v obhajobě.

Co to znamená: Pokud soud sankce potvrdí, budou muset firmy využívající umělou inteligenci přehodnotit své postupy při uchovávání a poskytování záznamů během soudních řízení. Budou se muset zaměřit na transparentnost svých technických schopností a posílení ochrany soukromí uživatelů, aby se vyhnuly právním rizikům spojeným s nedodržováním povinností v rámci shromažďování důkazů.

Zdroje: