Anthropic oznámila, že se auto režim v nástroji Claude Code od 14. srpna stane výchozím nastavením pro nové relace v plánech Pro, Max a Team. Testovací verzi funkce firma podle serveru TechCrunch poprvé představila v březnu jako způsob, jak sladit rychlost práce agenta s kontrolou nad jeho jednáním. V auto režimu Claude Code nepožaduje schválení uživatele u každého kroku, ale postupuje samostatně, dokud nenarazí na akci, kterou Anthropic označuje za nevratnou, destruktivní nebo přesahující pracovní prostředí uživatele.
Klíčovým argumentem pro plošné nasazení je studie s 1 053 platícími testery, v níž byl uprostřed relace jeden schvalovací prompt nahrazen zjevně nebezpečným příkazem. Podle Anthropic auto režim v této situaci zablokoval 89 procent škodlivých akcí, zatímco lidský přehled odhalil a odmítl jen 13,6 procenta z nich. Firma tento rozdíl vysvětluje tím, že manuální schvalování se snadno stává rutinou · podle jejích údajů uživatelé automaticky odklikávají 97 procent bezpečnostních promptů. Vedoucí Claude Code Boris Cherny na síti X uvedl, že on i jeho tým už několik měsíců používají výhradně auto režim a že by se ke schvalovacím promptům nechtěli vracet.
Druhou rovinou bezpečnosti, kterou Anthropic řeší, je odolnost proti takzvané prompt injection · tedy vkládání škodlivých instrukcí do obsahu, který agent zpracovává z externích zdrojů. Firma si na toto téma nechala zpracovat nezávislé hodnocení od společnosti Trajectory Labs, jež ke 17. červenci 2026 otestovala aktuální veřejné verze Claude Code a konkurenčního nástroje Codex. Podle Anthropic v testu se 72 scénáři nepřímé prompt injection a 720 pokusy o útok neuspěl proti modelům Claude Fable 5, Opus 5 a Sonnet 5 běžícím v auto režimu ani jeden útok. Anthropic zároveň uvedla, že do Claude Code přidala nové bezpečnostní prvky, včetně filtrování prompt injection a přizpůsobitelných pravidel pro tvrdé odmítání akcí, které brání úniku dat.
Ne všichni pozorovatelé jsou přesvědčeni, že je problém vyřešen. Vývojář Simon Willison, který loni na rok 2026 předpověděl bezpečnostní krizi kódujících agentů, na svém blogu ocenil, že auto režim řeší únavu z opakovaného schvalování, kterou označuje za reálný problém snižující bezpečnost. Zároveň ale požaduje více nezávislého potvrzení účinnosti proti prompt injection a upozorňuje, že si dovede představit útok, před kterým by auto režim nemusel ochránit · například škodlivý balíček třetí strany, který agenta v rámci běžného pracovního postupu navede ke stažení dalšího škodlivého kódu. Zástupci Anthropic Cat Wu a Thariq Shihipar dříve na konferenci AI Engineer World’s Fair uvedli, že uvnitř firmy auto režim používá téměř každý zaměstnanec a že rizika prompt injection a úniku dat jsou podle jejich hodnocení nyní nižší než u průměrného lidského revizora.
Co to znamená: Firmy nasazující Claude Code by si měly ověřit, zda jim výchozí přepnutí na auto režim od 14. srpna vyhovuje z hlediska interních bezpečnostních politik, a případně jej explicitně vypnout tam, kde vyžadují manuální schvalování kritických operací. Vzhledem k tomu, že klíčová čísla o účinnosti pocházejí především od samotné Anthropic a nezávislé ověření je zatím omezené, je do doby dalších externích auditů vhodné zachovat dodatečné kontrolní mechanismy, zejména u agentů s přístupem k citlivým datům nebo produkčním systémům.
Zdroje: