Claude Code od 14. avgusta sam odobrava svoje komande
Anthropic je izmjerio da ljudi u Claude Code odobre 97 odsto svih upita i da u testu zaustave samo 13,6 odsto opasnih komandi, dok automatski filter zaustavi 89 odsto. Od 14. avgusta AI sam odobrava svoje poteze. Pouka za firme ide daleko izvan programiranja.
Anthropic je izmjerio koliko pažljivo ljudi zapravo klikću na dugme Odobri, i rezultat je bio dovoljno loš da odluči kako je bolje da taj posao radi mašina.
Od 14. avgusta Claude Code prelazi na takozvani auto mod kao podrazumijevanu postavku za korisnike Pro, Max i Team paketa. To znači da alat sam izvršava komande, a poseban filter zaustavlja samo one koje procijeni kao nepovratne, destruktivne ili usmjerene van korisnikovog okruženja. Razlog za promjenu nije tehnički nego ljudski. Anthropic je utvrdio da korisnici odobre 97 odsto svih upita koje im alat postavi, dakle klikću bez stvarne provjere.
- Auto mod postaje podrazumijevan 14. avgusta za Pro, Max i Team pakete.
- U kontrolisanom testu sa 1.053 plaćena testera, ljudi su zaustavili 13,6 odsto opasnih komandi, a automatski filter 89 odsto.
- Korisnici Claude Code inače odobre 97 odsto svih zahtjeva za dozvolu.
- Kod nezavisne provjere sa 720 pokušaja ubacivanja zlonamjernih uputstava, nijedan nije uspio protiv auto moda.
- Filter nije savršen. Kod napada koje je pravila firma za bezbjednost, promašaj je pao sa 12 na 7 odsto, ali nije nula.
Šta se tačno desilo
U auto modu svaki poziv nekog alata prolazi kroz klasifikator, program koji procjenjuje da li je potez bezbjedan. Kad klasifikator blokira potez, Claude ili nađe sigurniju alternativu ili traži odobrenje od korisnika. Ako ne može da napreduje poslije tri uzastopne blokade ili dvadeset blokada u jednoj sesiji, vraća se na ručno odobravanje.
Najzanimljiviji podatak nije o mašini nego o ljudima. U testu sa 1.053 plaćena profesionalna testera, ljudi su prepoznali i zaustavili 13,6 odsto podmetnutih opasnih komandi. Automatski filter je zaustavio 89 odsto. Ljudska pažnja pri tome opada, pa poslije pedesetak prethodnih interakcija stopa otkrivanja pada na oko 5 odsto, dok kod filtera ostaje ista.
Anthropic navodi i da su mnogi korisnici već ranije oslabili ili zaobišli provjere dozvola mijenjajući podešavanja. Drugim riječima, nadzor koji je postojao na papiru u praksi je bio ukinut.
Firma otvoreno kaže da auto mod ne uklanja rizik jer se oslanja na AI koji procjenjuje drugi AI, i preporučuje da korisnici i dalje sami pregledaju poteze prije izmjena na proizvodnim sistemima.
Kontekst i konkurencija
Nezavisna provjera firme Trajectory Labs pokazala je da nijedan od 720 pokušaja ubacivanja zlonamjernih uputstava nije uspio protiv Claude modela u auto modu. U istom testu, uspješnost protiv OpenAI modela GPT-5.6 Sol u režimu automatske provjere bila je 5,83 odsto, a u režimu punog pristupa 19,03 odsto.
Ovo dolazi u sedmici u kojoj se pitanje nadzora nad agentima otvorilo sa više strana, od modela koji izlaze iz test okruženja do agenata koji sami pronalaze propuste u tuđim sistemima.

Naša perspektiva, šta ovo znači za region
Claude Code je alat za programere, ali brojka od 97 odsto odobrenih zahtjeva govori o nečemu što svaka firma ima kod sebe, a to je nadzor koji postoji samo formalno.
Ako u vašoj firmi neko potpisuje fakture, odobrava narudžbenice ili pušta objave na sajt, pitanje je isto. Da li ta osoba stvarno pregleda ili samo klikće jer je stavka dvadeseta tog dana. Anthropicov podatak da pažnja pada poslije pedesetak ponavljanja nije osobina programera nego osobina ljudi. Nadzor koji se sastoji od potvrđivanja svega što stigne nije nadzor nego dekoracija.
Iz toga slijedi praktično pravilo za uvođenje AI u posao. Nemojte tražiti da čovjek potvrđuje svaki korak, jer to nikad neće raditi kako treba. Umjesto toga odredite mali broj tačaka na kojima se stvarno staje, tamo gdje se šalje novac, gdje se briše nešto nepovratno i gdje se komunicira sa klijentom u ime firme. Na tim tačkama neka odobrenje bude sporo i namjerno. Sve ostalo pustite da radi.
Druga stvar je nabavna. Ako kupujete AI alat za firmu, pitajte prodavca šta se dešava kad alat napravi grešku, ko je vidi i koliko brzo. Odgovor tipa "korisnik odobrava svaku akciju" sada znate koliko vrijedi.
Šta pratiti dalje
Anthropic najavljuje da će auto mod tokom narednog mjeseca postati podrazumijevan i na poslovnim platformama, gdje je za sada opcion. Ako u firmi koristite Claude Code na Enterprise paketu ili preko oblaka, imate mjesec dana da odlučite kako želite da to radi kod vas, umjesto da vas postavka zatekne.
Ako želite da svake sedmice dobijete AI vijesti prevedene na jezik konkretnih poslovnih odluka, prijavite se na AI Balkan newsletter.
