Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha
Anthropic muudab autonoomse režiimi Claude Code’i vaikeseadeks Pro, Maxi ja Teami pakettides — alates 14. augustist sooritab agent toimingud ise, küsimata igal sammul kinnitust. Ettevõtte väitel tuvastab autonoomne režiim nüüd ohtlikud tegevused inimesest paremini.
Miks on autonoomia nüüd turvalisem
Anthropic viitab testile, milles osales 1053 tasulist arendajat. Seansi keskel asendati üks loataotlus selgelt ohtliku käsuga ning jälgiti, kas osaleja selle heaks kiidab. Ainult 13,6% osalejatest keeldus pahatahtlikust toimingust. Autonoomne režiim oleks blokeerinud 89% sellistest toimingutest.
Eraldi hindamises katsetas kolmanda osapoole ettevõte Trajectory Labs 72 kaudse prompt-injektsiooni stsenaariumi — olukordi, kus pahatahtlikud juhised on peidetud sisusse, mida agent väljastpoolt loeb. Ükski 720 rünnakust ei õnnestunud autonoomses režiimis Claude Fable 5, Opus 5 ega Sonnet 5 mudelite vastu.
Mida see arendajatele tähendab
Varem oli autonoomne režiim valik, mille kasutaja pidi käsitsi sisse lülitama. Nüüd saab sellest vaikekäitumine. Tavalisel arendajal tähendab see vähem klikke kinnitamiseks ja sujuvamat tööd, kuid samal ajal ka suuremat usaldust agendi vastu: agent otsustab ise, milliseid käske täita, sealhulgas võõra koodi ja andmetega töötamisel.
Kriitikud märgivad, et autonoomne režiim ei kaitse kõigi rünnakute eest. Näiteks pahatahtlik pakett, mis palub agendil „esmalt mudelifailid alla laadida“, võib andmed väljapoole saata ning autonoomne režiim ei pruugi seda märgata. Anthropic tunnistab, et autonoomne režiim laseb siiski läbi 11% ohtlikest toimingutest.
Trend: agendid võtavad kontrolli enda kätte
See on osa laiemast nihkest: AI-agendid lakkavad olemast abilised, kes heakskiitu ootavad, ning muutuvad täideviijateks, kellele usaldatakse rutiinsed ja ohtlikud toimingud. Küsimus ei ole selles, kas agent suudab töötada autonoomselt, vaid selles, kus jookseb usalduse piir — ja kes vastutab, kui autonoomia viib veani.













