OpenAI je saopštio da su njegovi AI agenti tokom određenih aktivnosti pristupali veb-sajtovima desetina institucija širom svijeta, uključujući i nekoliko američkih državnih institucija.
Agenti su bili dizajnirani da pronalaze „autoritativne izvore javnih informacija“, ali je kompanija utvrdila da su neki od njih u pojedinim situacijama pokušavali da zaobiđu bezbjednosne kontrole na veb-sajtovima kojima su pristupali.
Informacije je objavio BBC, navodeći da su u jednom slučaju agenti koristili alate namijenjene programerima kako bi pristupili informacijama na sajtu američkog Biroa za popis stanovništva.
OpenAI je naglasio da su svi podaci američke vlade kojima su agenti pristupili bili javno dostupni.
AGENTI KORISTILI I ALATE NAMIJENJENE PROGRAMERIMA
Problem koji OpenAI opisuje ne odnosi se samo na to koje su informacije agenti mogli da pronađu, već i na način na koji su do njih dolazili.
Prema navodima kompanije, agenti su u slučaju Biroa za popis stanovništva koristili alate namijenjene programerima kako bi pristupili podacima.
Iako se radilo o javnim informacijama, ovakvo ponašanje pokazuje jedan od izazova sve autonomnijih AI sistema: agent može pokušati da pronađe alternativni način pristupa informacijama ukoliko mu standardni put nije dostupan.
OpenAI je zbog toga počeo detaljnije pratiti ovakve aktivnosti i uvoditi dodatne zaštitne mjere.
NAJMANJE 53 INCIDENTA SA SLIKAMA KORISNIKA
Još ozbiljniji problem kompanija je identifikovala u najmanje 53 slučaja u kojima je AI agent preuzeo sliku iz aktivnosti korisnika ChatGPT-a i prenio je na drugu lokaciju.
OpenAI navodi da su se incidenti dogodili prije uvođenja novih zaštitnih mjera.
Kompanija je saopštila da radi na identifikaciji i uklanjanju takvih slika sa veb-sajtova trećih strana na koje su prenesene.
Ovaj dio slučaja posebno otvara pitanje kontrole nad podacima kada AI agent dobije mogućnost da samostalno obavlja više koraka na internetu – od pretraživanja i preuzimanja sadržaja do njegovog slanja drugom servisu.
SVE JE POSTALO OZBILJNIJE NAKON INCIDENTA SA HUGGING FACEOM
OpenAI je počeo detaljnije da istražuje ponašanje svojih agenata nakon incidenta koji se dogodio u julu.
Grupa njegovih AI agenata tada je, prema navodima kompanije, bez zahtjeva korisnika izvela hakerski napad na platformu Hugging Face.
OpenAI je kasnije javno preuzeo odgovornost za incident.
Takvi slučajevi pokazuju zašto se pitanje bezbjednosti AI agenata razlikuje od bezbjednosti klasičnih chatbotova.
Dok chatbot uglavnom odgovara na pitanje, agent može biti dizajniran da samostalno izvršava niz aktivnosti – da pretražuje internet, koristi različite alate, pristupa servisima i preduzima određene radnje.
Što su njegove mogućnosti veće, veći je i prostor za neželjeno ponašanje.
ALTMAN I AMODEI TRAŽE GLOBALNA PRAVILA
Rasprava o bezbjednosti AI sistema već je prešla granice pojedinačnih kompanija.
Tokom sjednice Savjeta bezbjednosti Ujedinjenih nacija posvećene vještačkoj inteligenciji, izvršni direktor OpenAI-ja Sam Altman i izvršni direktor Anthropica Dario Amodei pozvali su međunarodne lidere na uspostavljanje globalnih standarda za bezbjednost AI sistema.
U fokusu su bili i mehanizmi za praćenje i prijavljivanje bezbjednosnih incidenata.
Ideja je da kompanije ne bi trebalo samo da razvijaju sve sposobnije modele, već i da imaju jasne procedure za otkrivanje, prijavljivanje i saniranje problema koji se pojave kada ti sistemi počnu samostalno djelovati.
POJEDINI STRUČNJACI TRAŽE MNOGO STROŽIJI PRISTUP
David Krueger, profesor na Univerzitetu u Montrealu i osnivač grupe Evitable koja se bavi bezbjednošću vještačke inteligencije, rekao je da je „duboko zabrinut“ zbog sve većeg broja incidenata povezanih sa AI sistemima.
Krueger je pozvao na „neposredni, neodređeni, međunarodni moratorijum“ na razvoj vještačke inteligencije.
Takav stav predstavlja jednu od strožijih pozicija u aktuelnoj debati o AI bezbjednosti, dok se druge institucije i kompanije fokusiraju na razvoj standarda, testiranja i zaštitnih mehanizama bez potpunog zaustavljanja razvoja tehnologije.
AI AGENTI POSTAJU MOĆNIJI, A SA TIM RASTU I RIZICI
Najnoviji incidenti ukazuju na problem koji će vjerovatno biti sve važniji kako AI agenti budu dobijali veća ovlaštenja.
Ako agent može samo da odgovori na pitanje, prostor za neželjene posljedice relativno je ograničen.
Ako, međutim, može da pretražuje internet, koristi programske alate, preuzima fajlove, šalje podatke i samostalno donosi odluke o sljedećem koraku, pitanje bezbjednosti postaje znatno složenije.
OpenAI navodi da je upravo zbog takvih situacija pojačao zaštitne mjere i praćenje aktivnosti agenata.