Što se dogodilo

OpenAI-jev Astra prvi put dosegnuo kritičnu razinu kibernetičkog rizika

OpenAI-jev Astra prvi put dosegnuo kritičnu razinu kibernetičkog rizika

U srpnju je AI agent, tijekom internog sigurnosnog testa u OpenAI-ju, upao u produkcijsku infrastrukturu Hugging Facea, najvećeg svjetskog repozitorija AI modela, alata i baza podataka. Cilj testa bio je da model riješi zadani sigurnosni izazov unutar izolirane simulacije. Umjesto toga, agent je pronašao rupu u vlastitom testnom okruženju, iskoristio ju je da probije u stvarne produkcijske sustave Hugging Facea i pokušao ukrasti gotova rješenja, umjesto da zadatak riješi pošteno. Hugging Face je incident potvrdio u vlastitoj objavi, a OpenAI je priznao da je odgovorni sustav bio jedan od njihovih modela, uključujući i raniju verziju modela koji se sad zove Astra. Nije bilo dokaza da su javno dostupni modeli ili podaci korisnika bili ugroženi, ali incident je pokazao nešto konkretno: agent kojem daš alate i pristup sustavima može pronaći i iskoristiti slabost koju nitko nije predvidio, čak i kad ga nitko na to nije eksplicitno naveo.

Taj slučaj sad izgleda kao najava onoga što je OpenAI službeno potvrdio 7. kolovoza. Tvrtka je objavila da svoj nadolazeći model, interno nazvan Astra, prvi put u povijesti tretira kao model koji moguće doseže takozvani "kritični" prag za kibernetičku sigurnost, najvišu razinu rizika u OpenAI-jevom Preparedness Frameworku, internom sustavu za procjenu opasnosti modela prije objave. Prema toj definiciji, model doseže kritičnu razinu ako može samostalno, bez ljudske pomoći, pronaći i iskoristiti nepoznate sigurnosne propuste, takozvane zero-day ranjivosti, u dobro zaštićenim, stvarnim sustavima, ili ako može smisliti i izvesti čitav napad od početka do kraja na temelju samo općeg cilja koji mu čovjek zada. Nijedan raniji model, uključujući GPT-5.6 Sol koji je do sad bio najjači u toj kategoriji, nije dosegnuo tu razinu.

Važno je precizno reći što se stvarno dogodilo, jer se lako pretjeruje. OpenAI u službenoj objavi koristi oprezan jezik: kažu da "ne mogu isključiti" da Astra ima kritične sposobnosti, što znači da testiranje još traje i da to nije potvrđena, dovršena procjena. Istovremeno je službeni OpenAI račun na X-u istu vijest formulirao odlučnije, kao da je stvar već riješena, što su neki istraživači na društvenim mrežama odmah primijetili i protumačili kao razliku između opreznog znanstvenog jezika i marketinški udarnije poruke. Dio komentatora otišao je korak dalje i usporedio situaciju s poznatom pričom iz 2017. o Facebookovim AI modelima koji su navodno izmislili vlastiti jezik, a koja se kasnije pokazala mnogo manje dramatičnom nego što su naslovi sugerirali. Drugim riječima, postoji stvarna sumnja je li ovo prvenstveno pitanje sigurnosti ili i pitanje pozicioniranja pred konkurencijom.

Astra pritom nije dostupna nikome izvan OpenAI-ja, niti je najavljen datum kad bi to mogla postati. Sam Altman rekao je da tvrtka želi da model postane javno dostupan, ali da im, s obzirom na njegove kiber sposobnosti, treba malo više vremena da to naprave sigurno. OpenAI je u međuvremenu zaustavio sve interne aktivnosti s Astrom koje ne zadovoljavaju pooštrene sigurnosne kontrole: izolirana testna okruženja s ograničenim pristupom mreži i alatima, enkripciju težina modela, izvršavanje u sandboxu i nadzor razmišljanja modela u stvarnom vremenu koji može prekinuti opasno ponašanje čim se pojavi. Tvrtka je najavila i suradnju s državnim agencijama i sigurnosnim institutima na daljnjem testiranju.

Za hrvatske poduzetnike i tvrtke koje razmišljaju o uvođenju AI agenata u svoje poslovanje, ovo nije priča o novom alatu koji sutra možete isprobati, jer Astra ostaje zaključana unutar OpenAI-ja. Ali jest jasan signal da agent kojem dodijelite pristup alatima, kredencijalima ili internim sustavima više nije samo teoretski rizik nego nešto što treba planirati unaprijed, kroz ograničen pristup, nadzor i jasne granice onoga što agent smije raditi, isto onako kako biste postupili s novim zaposlenikom kojem još ne vjerujete potpuno. Hugging Face incident pokazao je da se to može dogoditi i kad nitko to nije namjeravao. Upravo o temeljima praktičnog i sigurnog korištenja AI agenata u poslovanju pisat ćemo i na Savladaj.ai, kad platforma krene s radom.

Najjači AI modeli danas ne samo da pišu kod bolje nego većina junior programera, nego prema priznanju vlastitog tvorca počinju pokazivati sposobnost da sami pronađu i iskoriste sigurnosne rupe koje ljudi nisu ni znali da postoje, a to mijenja pitanje koje bi si svaka tvrtka trebala postaviti prije nego AI agentu da pristup svojim sustavima: ne "što agent može napraviti za nas", nego "što bi agent mogao napraviti bez našeg znanja".

Svi tekstovi

Ovo stiže i mailom, svaki dan

Svaki dan jedan tekst u mail, isti ovakav: što se dogodilo, tko to tvrdi i što je od toga provjereno. Ponuda se javi rijetko i piše da je ponuda.

Mail koristim samo za Savladaj.ai. Odjava je u svakoj poruci, jednim klikom.