Upozornenie: Tento príspevok bol vytvorený za asistencie umelej inteligencie pod vedením a s redakčnými úpravami človeka.
Spoločnosť Anthropic začne od 14. augusta pri platených účtoch v nástroji Claude Code automaticky vykonávať programátorské úkony bez manuálnych výziev na schválenie.
Vývojár umelej inteligencie, spoločnosť Anthropic, upravuje svoj programátorský nástroj pre príkazový riadok Claude Code tak, aby softvérové úlohy spúšťal bez nutnosti vyžadovať manuálne povolenie pri každom kroku. Vývojári s platenými účtami už nebudú musieť kontrolovať bežné príkazy v termináli, čo výrazne urýchli viacstupňový vývoj softvéru. Táto zmena rieši bezpečnostné riziká spôsobené vývojármi, ktorí zo zvyku odklikávajú bezpečnostné výzvy bez toho, aby si ich prečítali.
Prečo je to dôležité
Obrazovky so žiadosťami o povolenie zlyhávajú ako bezpečnostná bariéra, pretože ich vývojári bežne schvaľujú bez akejkoľvek kontroly. Telemetrické údaje spoločnosti Anthropic ukázali, že vývojári reflexívne potvrdia až 97 % týchto výziev. Pri 62 % interaktívnych relácií navyše využili plošné príkazy na ich úplné potlačenie. Tým, že sa bezpečnostné kontroly presunú na špecializovaný inšpekčný model, softvér dokáže zachytiť podstatne viac škodlivých alebo deštruktívnych akcií než ľudskí operátori počas dlhých programátorských maratónov.
Únava zo schvaľovania (approval fatigue) pramení z vysokého počtu úkonov, ktoré agentický systém vykonáva počas komplexných zostavení (buildov). Relácie v Claude Code často vyvolávajú desiatky až stovky terminálových kontrol za hodinu. Firemná telemetria odhalila, že 49,5 % aktívnych používateľov príkazového riadka si vytvorilo plošné shell pravidlá, aby obišli jednotlivé kontroly, zatiaľ čo 43 % povolilo vykonávanie príkazov naprieč celými interpretmi, ako sú Python alebo Node. Dáta Anthropicu ukázali, že kým vývojári zamietli iba 3 % výziev pri jednotlivých príkazoch, odmietli až 39 % navrhovaných plánov na vyššej úrovni, keď im boli predložené architektonické možnosti. Tento kontrast naznačuje, že ľudský dohľad je oveľa efektívnejší vo fáze plánovania architektúry než na úrovni schvaľovania jednotlivých čiastkových príkazov.
Automatizované kontroly zachytia viac hrozieb ako ľudský dohľad
Spoločnosť Anthropic otestovala túto zmenu v slepom teste s 1 053 platenými profesionálnymi testermi. Počas realistických programátorských úloh výskumníci tajne nahradili jednu z bežných schvaľovacích výziev nebezpečným príkazom. Ľudskí kontrolóri zachytili hrozbu len v 13,6 % prípadov (143 z 1 053), pričom zvyšné výzvy pre únavu z rozhodovania schválili. Automatizovaný klasifikátor od Anthropicu zachytil 89 % tých istých hrozieb (937 z 1 053).
Mechanizmus sa spolieha na sekundárny klasifikačný model, ktorý beží súbežne s hlavným programátorským agentom. Keď kódovací agent vygeneruje príkaz pre shell alebo úpravu súboru, klasifikátor pred samotným spustením skontroluje toto volanie nástroja (tool call). Zablokuje akúkoľvek akciu, ktorú vyhodnotí ako nezvratnú, deštruktívnu alebo nasmerovanú mimo hlavný adresár projektu.
Ak je akcia zablokovaná, programátorský agent sa pokúsi nájsť bezpečnejšiu cestu, alebo požiada vývojára o explicitné povolenie. Nezávislá bezpečnostná firma Trajectory Labs otestovala túto architektúru proti 72 rôznym útokom typu prompt injection (vkladanie škodlivých príkazov do vstupného textu), pričom vo svojej správe potvrdila, že klasifikátor zablokoval všetkých 72 pokusov.
Anthropic zdokumentoval aj interné prípady, kedy klasifikátor počas firemného testovania zabránil chybám samotného agenta. V jednom prípade, keď zlyhalo interné nahrávanie súboru, sa programátorský agent pokúsil publikovať chybovú správu na verejnej platforme pre zdieľanie kódu – klasifikátor tento pokus zablokoval. Pri inej relácii sa agent pokúsil naraz ukončiť približne dvetisíc serverových procesov, čo klasifikátor okamžite zachytil ako deštruktívnu hromadnú operáciu.
Nástroje na správu a časový plán nasadenia
Systém zahŕňa aj ochranné prvky pre firemnú bezpečnostnú politiku. Systémoví administrátori môžu nastaviť prísne pravidlá na permanentné zamietnutie (hard deny), ktoré trvalo zablokujú špecifické príkazy, ako je napríklad odosielanie (push) kódu do verejných repozitárov alebo príkazy curl spúšťajúce externé skripty. Tieto mantinely vstupujú do platnosti ešte pred spustením klasifikátora a umelá inteligencia ich nedokáže obísť.
Automatizovaný model však nie je stopercentne neomylný. V testoch klasifikátor zachytil 89 % nebezpečných príkazov, no 11 % hrozieb zostalo nezablokovaných. Aby sa predišlo vymknutiu automatizácie spod kontroly, systém sa vráti k manuálnemu schvaľovaniu v prípade, že klasifikátor vyvolá tri po sebe idúce blokovania alebo zablokuje akciu dvadsaťkrát v rámci jednej pracovnej relácie.
Každá takáto klasifikačná kontrola so sebou prináša mierne zvýšenie počtu spracovaných tokenov pri volaní nástrojov. Anthropic uviedol, že tieto dodatočné náklady na výpočtový výkon pri predplatiteľských plánoch pokryje a neprenesie ich na používateľov. Boris Cherny, šéf tímu Claude Code v spoločnosti Anthropic, na sociálnych sieťach vyhlásil, že jeho vlastný vývojársky tím už mesiace funguje výhradne v automatickom režime. Predvolená zmena vstúpi do platnosti 14. augusta pre účty Pro, Max a Team, zatiaľ čo firemné balíky Enterprise a úrovne API dostanú možnosti riadeného nasadenia v priebehu septembra.
Zdroje
Automatický režim je teraz predvolený v nástroji Claude Code pre plány Pro, Max a Team – Oficiálny blog spoločnosti Anthropic: https://claude.com/blog/auto-mode-default-in-claude-code
Konfigurácia automatického režimu – Dokumentácia ku Claude Code: https://code.claude.com/docs/en/auto-mode-config







