Što se dogodilo

Claude Code od 14. kolovoza sam odlučuje umjesto vas

Claude Code od 14. kolovoza sam odlučuje umjesto vas

Devedeset sedam posto. Toliko puta korisnici Claude Codea, Anthropicovog AI alata za programiranje, jednostavno kliknu "odobri" kad ih agent pita smije li nešto napraviti, najčešće bez čitanja što točno traži. Anthropic je tu naviku prepoznao kao problem, a ne kao sigurnost, i zato od 14. kolovoza mijenja način na koji Claude Code radi za sve korisnike na Pro, Max i Team planovima.

Do sada je princip bio jednostavan: agent pita, čovjek odobrava ili odbija, korak po korak. Mnogi programeri su to zaobilazili tako što su potvrde potpuno isključili i pustili agenta da radi što hoće, što je još rizičnije. Anthropic sada uvodi treću opciju, takozvani auto mode, u kojem poseban klasifikator provjerava svaku akciju koju Claude Code želi napraviti prije nego je izvrši. Sigurne akcije prolaze automatski, a one koje klasifikator prepozna kao nepovratne, destruktivne ili usmjerene izvan projektnog okruženja se blokiraju ili se za njih ipak traži potvrda korisnika. Prema službenoj Anthropicovoj objavi, ovo od 14. kolovoza postaje zadano ponašanje za nove sesije na Pro, Max i Team planovima, dok korisnici Enterprise plana i oni koji Claude Code koriste preko API-ja auto mode za sada moraju sami uključiti.

Anthropic tvrdi da iza promjene stoji konkretno testiranje: u kontroliranoj studiji s 1053 plaćena testera, ljudski recenzenti su namjerno ubačene opasne naredbe uočili u samo 13,6 posto slučajeva, dok je klasifikator u auto modeu uhvatio 89 posto. Tvrtka također navodi da timovi koji koriste auto mode isporučuju otprilike 25 posto više pull requestova, no to je njihova vlastita metrika produktivnosti, ne nezavisno potvrđena brojka. Zanimljivo je da je nezavisni evaluator Trajectory Labs, prema dostupnim izvještajima, na Claude modelima u auto modeu proveo 720 pokušaja takozvanog indirektnog prompt injectiona i nijedan nije uspio, što je barem djelomična vanjska provjera Anthropicovih tvrdnji, iako je riječ o jednom testu ograničenog opsega.

Nisu svi uvjereni. Simon Willison, neovisni istraživač koji već godinama prati sigurnosne probleme AI agenata, upozorava da nije jasno hvata li klasifikator suptilnije, indirektne napade, one gdje zlonamjerna uputa nije već u naredbi koju agent šalje, nego skrivena u sadržaju kojem agent već vjeruje, primjerice na webu ili u paketu trećeg dobavljača. Takav napad klasifikatoru jednostavno ne izgleda kao opasna naredba. Na X-u su reakcije programera mješovite: neki pozdravljaju manje prekidanja tijekom rada, dok drugi na Hacker Newsu upozoravaju da će nejasno postavljen zadatak u auto modeu agentu dati mnogo više prostora da napravi nešto što korisnik zapravo nije htio.

Za svakog tko u svojoj firmi ili timu već koristi Claude Code, ovo nije apstraktna vijest. Ako imate Pro, Max ili Team plan, promjena će se dogoditi automatski čim otvorite novu sesiju nakon 14. kolovoza, osim ako ste već ručno postavili drugačiji način rada, u kojem slučaju dobivate jednokratni upit želite li prijeći na auto mode. Način rada možete promijeniti u bilo kojem trenutku kombinacijom Shift+Tab, a administratori timova mogu auto mode potpuno isključiti kroz postavke organizacije. Prije nego što kliknete dalje, vrijedi barem razumjeti što klasifikator stvarno pokriva, pogotovo ako agent u vašem projektu ima pristup vanjskim alatima, paketima ili webu.

Ovakve promjene u zadanim postavkama najvećih AI alata pratimo i u Savladaj.ai, jer upravo od takvih detalja ovisi hoće li AI u vašoj firmi biti koristan alat ili skupa greška. Što više AI agenata preuzima svakodnevne odluke bez pitanja, manje je važno hoćemo li im vjerovati, a više koliko ćemo se truditi provjeravati što rade dok mi ne gledamo.

Svi tekstovi

Ovo stiže i mailom, svaki dan

Svaki dan jedan tekst u mail, isti ovakav: što se dogodilo, tko to tvrdi i što je od toga provjereno. Ponuda se javi rijetko i piše da je ponuda.

Mail koristim samo za Savladaj.ai. Odjava je u svakoj poruci, jednim klikom.