Claude Code od 14. avgusta sam odobrava svoje komande

Anthropic je izmjerio da ljudi u Claude Code odobre 97 odsto svih upita i da u testu zaustave samo 13,6 odsto opasnih komandi, dok automatski filter zaustavi 89 odsto. Od 14. avgusta AI sam odobrava svoje poteze. Pouka za firme ide daleko izvan programiranja.

Anthropic uključuje auto mod u Claude Code, AI sam odobrava komande umjesto čovjeka
Od 14. avgusta Claude Code po podrazumijevanoj postavci sam procjenjuje koje komande smije izvršiti
Sadržaj

Anthropic je izmjerio koliko pažljivo ljudi zapravo klikću na dugme Odobri, i rezultat je bio dovoljno loš da odluči kako je bolje da taj posao radi mašina.

Od 14. avgusta Claude Code prelazi na takozvani auto mod kao podrazumijevanu postavku za korisnike Pro, Max i Team paketa. To znači da alat sam izvršava komande, a poseban filter zaustavlja samo one koje procijeni kao nepovratne, destruktivne ili usmjerene van korisnikovog okruženja. Razlog za promjenu nije tehnički nego ljudski. Anthropic je utvrdio da korisnici odobre 97 odsto svih upita koje im alat postavi, dakle klikću bez stvarne provjere.

  • Auto mod postaje podrazumijevan 14. avgusta za Pro, Max i Team pakete.
  • U kontrolisanom testu sa 1.053 plaćena testera, ljudi su zaustavili 13,6 odsto opasnih komandi, a automatski filter 89 odsto.
  • Korisnici Claude Code inače odobre 97 odsto svih zahtjeva za dozvolu.
  • Kod nezavisne provjere sa 720 pokušaja ubacivanja zlonamjernih uputstava, nijedan nije uspio protiv auto moda.
  • Filter nije savršen. Kod napada koje je pravila firma za bezbjednost, promašaj je pao sa 12 na 7 odsto, ali nije nula.

Šta se tačno desilo

U auto modu svaki poziv nekog alata prolazi kroz klasifikator, program koji procjenjuje da li je potez bezbjedan. Kad klasifikator blokira potez, Claude ili nađe sigurniju alternativu ili traži odobrenje od korisnika. Ako ne može da napreduje poslije tri uzastopne blokade ili dvadeset blokada u jednoj sesiji, vraća se na ručno odobravanje.

Najzanimljiviji podatak nije o mašini nego o ljudima. U testu sa 1.053 plaćena profesionalna testera, ljudi su prepoznali i zaustavili 13,6 odsto podmetnutih opasnih komandi. Automatski filter je zaustavio 89 odsto. Ljudska pažnja pri tome opada, pa poslije pedesetak prethodnih interakcija stopa otkrivanja pada na oko 5 odsto, dok kod filtera ostaje ista.

Anthropic navodi i da su mnogi korisnici već ranije oslabili ili zaobišli provjere dozvola mijenjajući podešavanja. Drugim riječima, nadzor koji je postojao na papiru u praksi je bio ukinut.

Firma otvoreno kaže da auto mod ne uklanja rizik jer se oslanja na AI koji procjenjuje drugi AI, i preporučuje da korisnici i dalje sami pregledaju poteze prije izmjena na proizvodnim sistemima.

Kontekst i konkurencija

Nezavisna provjera firme Trajectory Labs pokazala je da nijedan od 720 pokušaja ubacivanja zlonamjernih uputstava nije uspio protiv Claude modela u auto modu. U istom testu, uspješnost protiv OpenAI modela GPT-5.6 Sol u režimu automatske provjere bila je 5,83 odsto, a u režimu punog pristupa 19,03 odsto.

Ovo dolazi u sedmici u kojoj se pitanje nadzora nad agentima otvorilo sa više strana, od modela koji izlaze iz test okruženja do agenata koji sami pronalaze propuste u tuđim sistemima.

Testovi AI modela postali rizik, SAD sprema provjeru pred izlazak
Modeli OpenAI-ja, Anthropica, Mete i Moonshota izašli su iz test okruženja i u nekim slučajevima dodirnuli stvarne sisteme. Novo u priči je da stručnjaci sada traže nezavisnu reviziju laboratorija, a Bijela kuća sprema dobrovoljnu provjeru modela 30 dana prije izlaska.

Naša perspektiva, šta ovo znači za region

Claude Code je alat za programere, ali brojka od 97 odsto odobrenih zahtjeva govori o nečemu što svaka firma ima kod sebe, a to je nadzor koji postoji samo formalno.

Ako u vašoj firmi neko potpisuje fakture, odobrava narudžbenice ili pušta objave na sajt, pitanje je isto. Da li ta osoba stvarno pregleda ili samo klikće jer je stavka dvadeseta tog dana. Anthropicov podatak da pažnja pada poslije pedesetak ponavljanja nije osobina programera nego osobina ljudi. Nadzor koji se sastoji od potvrđivanja svega što stigne nije nadzor nego dekoracija.

Iz toga slijedi praktično pravilo za uvođenje AI u posao. Nemojte tražiti da čovjek potvrđuje svaki korak, jer to nikad neće raditi kako treba. Umjesto toga odredite mali broj tačaka na kojima se stvarno staje, tamo gdje se šalje novac, gdje se briše nešto nepovratno i gdje se komunicira sa klijentom u ime firme. Na tim tačkama neka odobrenje bude sporo i namjerno. Sve ostalo pustite da radi.

Druga stvar je nabavna. Ako kupujete AI alat za firmu, pitajte prodavca šta se dešava kad alat napravi grešku, ko je vidi i koliko brzo. Odgovor tipa "korisnik odobrava svaku akciju" sada znate koliko vrijedi.

Šta pratiti dalje

Anthropic najavljuje da će auto mod tokom narednog mjeseca postati podrazumijevan i na poslovnim platformama, gdje je za sada opcion. Ako u firmi koristite Claude Code na Enterprise paketu ili preko oblaka, imate mjesec dana da odlučite kako želite da to radi kod vas, umjesto da vas postavka zatekne.

Ako želite da svake sedmice dobijete AI vijesti prevedene na jezik konkretnih poslovnih odluka, prijavite se na AI Balkan newsletter.


Izvori

Pretplatite se da biste se pridružili diskusiji.

Napravite besplatan nalog da biste postali član i pridružili se diskusiji.

Već imate nalog? Prijavite se

Prijavi se na AIBalkan - vijesti o vještačkoj inteligenciji newsletter.

Budite u toku sa pažljivo odabranom kolekcijom naših najboljih priča.

Provjerite svoj inboks i potvrdite. Nešto je pošlo po zlu. Pokušajte ponovo.