Anthropic ruší požiadavky na schvaľovanie v Claude Code

Od 14. augusta prepne spoločnosť Anthropic nástroj Claude Code do automatického režimu pre platené úrovne účtov. Manuálne požiadavky na povolenia nahradí automatizovaný klasifikátor.

Anthropic ruší požiadavky na schvaľovanie v Claude Code
Robot pisuci kod (Zdroj: Generovane pomocou ChatGPT)
Písmo: A- | A+

Upozornenie: Tento príspevok bol vytvorený za asistencie umelej inteligencie pod vedením a s redakčnými úpravami človeka.

Spoločnosť Anthropic začne od 14. augusta pri platených účtoch v nástroji Claude Code automaticky vykonávať programátorské úkony bez manuálnych výziev na schválenie.

Vývojár umelej inteligencie, spoločnosť Anthropic, upravuje svoj programátorský nástroj pre príkazový riadok Claude Code tak, aby softvérové úlohy spúšťal bez nutnosti vyžadovať manuálne povolenie pri každom kroku. Vývojári s platenými účtami už nebudú musieť kontrolovať bežné príkazy v termináli, čo výrazne urýchli viacstupňový vývoj softvéru. Táto zmena rieši bezpečnostné riziká spôsobené vývojármi, ktorí zo zvyku odklikávajú bezpečnostné výzvy bez toho, aby si ich prečítali.

SkryťVypnúť reklamu
Článok pokračuje pod video reklamou
SkryťVypnúť reklamu
Článok pokračuje pod video reklamou

Prečo je to dôležité

Obrazovky so žiadosťami o povolenie zlyhávajú ako bezpečnostná bariéra, pretože ich vývojári bežne schvaľujú bez akejkoľvek kontroly. Telemetrické údaje spoločnosti Anthropic ukázali, že vývojári reflexívne potvrdia až 97 % týchto výziev. Pri 62 % interaktívnych relácií navyše využili plošné príkazy na ich úplné potlačenie. Tým, že sa bezpečnostné kontroly presunú na špecializovaný inšpekčný model, softvér dokáže zachytiť podstatne viac škodlivých alebo deštruktívnych akcií než ľudskí operátori počas dlhých programátorských maratónov.

Únava zo schvaľovania (approval fatigue) pramení z vysokého počtu úkonov, ktoré agentický systém vykonáva počas komplexných zostavení (buildov). Relácie v Claude Code často vyvolávajú desiatky až stovky terminálových kontrol za hodinu. Firemná telemetria odhalila, že 49,5 % aktívnych používateľov príkazového riadka si vytvorilo plošné shell pravidlá, aby obišli jednotlivé kontroly, zatiaľ čo 43 % povolilo vykonávanie príkazov naprieč celými interpretmi, ako sú Python alebo Node. Dáta Anthropicu ukázali, že kým vývojári zamietli iba 3 % výziev pri jednotlivých príkazoch, odmietli až 39 % navrhovaných plánov na vyššej úrovni, keď im boli predložené architektonické možnosti. Tento kontrast naznačuje, že ľudský dohľad je oveľa efektívnejší vo fáze plánovania architektúry než na úrovni schvaľovania jednotlivých čiastkových príkazov.

SkryťVypnúť reklamu
SkryťVypnúť reklamu

Automatizované kontroly zachytia viac hrozieb ako ľudský dohľad

Spoločnosť Anthropic otestovala túto zmenu v slepom teste s 1 053 platenými profesionálnymi testermi. Počas realistických programátorských úloh výskumníci tajne nahradili jednu z bežných schvaľovacích výziev nebezpečným príkazom. Ľudskí kontrolóri zachytili hrozbu len v 13,6 % prípadov (143 z 1 053), pričom zvyšné výzvy pre únavu z rozhodovania schválili. Automatizovaný klasifikátor od Anthropicu zachytil 89 % tých istých hrozieb (937 z 1 053).

Mechanizmus sa spolieha na sekundárny klasifikačný model, ktorý beží súbežne s hlavným programátorským agentom. Keď kódovací agent vygeneruje príkaz pre shell alebo úpravu súboru, klasifikátor pred samotným spustením skontroluje toto volanie nástroja (tool call). Zablokuje akúkoľvek akciu, ktorú vyhodnotí ako nezvratnú, deštruktívnu alebo nasmerovanú mimo hlavný adresár projektu.

SkryťVypnúť reklamu

Ak je akcia zablokovaná, programátorský agent sa pokúsi nájsť bezpečnejšiu cestu, alebo požiada vývojára o explicitné povolenie. Nezávislá bezpečnostná firma Trajectory Labs otestovala túto architektúru proti 72 rôznym útokom typu prompt injection (vkladanie škodlivých príkazov do vstupného textu), pričom vo svojej správe potvrdila, že klasifikátor zablokoval všetkých 72 pokusov.

Anthropic zdokumentoval aj interné prípady, kedy klasifikátor počas firemného testovania zabránil chybám samotného agenta. V jednom prípade, keď zlyhalo interné nahrávanie súboru, sa programátorský agent pokúsil publikovať chybovú správu na verejnej platforme pre zdieľanie kódu – klasifikátor tento pokus zablokoval. Pri inej relácii sa agent pokúsil naraz ukončiť približne dvetisíc serverových procesov, čo klasifikátor okamžite zachytil ako deštruktívnu hromadnú operáciu.

SkryťVypnúť reklamu

Nástroje na správu a časový plán nasadenia

Systém zahŕňa aj ochranné prvky pre firemnú bezpečnostnú politiku. Systémoví administrátori môžu nastaviť prísne pravidlá na permanentné zamietnutie (hard deny), ktoré trvalo zablokujú špecifické príkazy, ako je napríklad odosielanie (push) kódu do verejných repozitárov alebo príkazy curl spúšťajúce externé skripty. Tieto mantinely vstupujú do platnosti ešte pred spustením klasifikátora a umelá inteligencia ich nedokáže obísť.

Automatizovaný model však nie je stopercentne neomylný. V testoch klasifikátor zachytil 89 % nebezpečných príkazov, no 11 % hrozieb zostalo nezablokovaných. Aby sa predišlo vymknutiu automatizácie spod kontroly, systém sa vráti k manuálnemu schvaľovaniu v prípade, že klasifikátor vyvolá tri po sebe idúce blokovania alebo zablokuje akciu dvadsaťkrát v rámci jednej pracovnej relácie.

Každá takáto klasifikačná kontrola so sebou prináša mierne zvýšenie počtu spracovaných tokenov pri volaní nástrojov. Anthropic uviedol, že tieto dodatočné náklady na výpočtový výkon pri predplatiteľských plánoch pokryje a neprenesie ich na používateľov. Boris Cherny, šéf tímu Claude Code v spoločnosti Anthropic, na sociálnych sieťach vyhlásil, že jeho vlastný vývojársky tím už mesiace funguje výhradne v automatickom režime. Predvolená zmena vstúpi do platnosti 14. augusta pre účty Pro, Max a Team, zatiaľ čo firemné balíky Enterprise a úrovne API dostanú možnosti riadeného nasadenia v priebehu septembra.

Zdroje

Automatický režim je teraz predvolený v nástroji Claude Code pre plány Pro, Max a Team – Oficiálny blog spoločnosti Anthropic: https://claude.com/blog/auto-mode-default-in-claude-code

Konfigurácia automatického režimu – Dokumentácia ku Claude Code: https://code.claude.com/docs/en/auto-mode-config

Martin Sečkár

Martin Sečkár

Bloger 
  • Počet článkov:  28
  •  | 
  • Páči sa:  24x

Pouzivam AI na pisanie pribehov, komentarov a svojho newsletra zamerane na AI novinky(https://www.linkedin.com/newsletters/svet-ai-tvoren%C3%BD-ai-7349186484307951619/). Priestor na sme.sk by som rad vyuzit na umiestnenie AI vytvorenych, clovekom overenych poviedok a komentarov k aktualnemu dianiu. Hladam priestor kde sa vyjadrit a neostat ticho v tejto zlozitej spolocenskej situacii. Zoznam autorových rubrík:  Nezaradená

Prémioví blogeri

Matúš Sarvaš

Matúš Sarvaš

3 články
Věra Tepličková

Věra Tepličková

1,236 článkov
Monika Nagyova

Monika Nagyova

305 článkov
Juraj Hipš

Juraj Hipš

12 článkov
Jana Čavojská

Jana Čavojská

26 článkov
Vladimír Rudl

Vladimír Rudl

114 článkov
reklama
SkryťZatvoriť reklamu