OpenAI priznao niz incidenata. “AI agenti rade neočekivane i zabrinjavajuće stvari”

Kompanija OpenAI priznala je da je upozorila više desetina institucija širom svijeta nakon što su njeni AI agenti nepropisno pristupali njihovim internet stranicama.

Riječ je o agentima, odnosno AI alatima dizajniranim da djelimično autonomno izvršavaju zadatke. Kako je saopštio OpenAI, oni su pokušavali da prikupe informacije sa sajtova „vlada, univerziteta, javnih agencija i drugih institucija“.

Među institucijama čijim su sajtovima agenti pristupali bili su američka Komisija za hartije od vrijednosti (SEC), Biro za popis stanovništva i Ministarstvo obrazovanja.

- TEKST NASTAVLJA ISPOD OGLASA -

Ovo priznanje dolazi samo nekoliko dana nakon što je australijski premijer Anthony Albanese saopštio da su OpenAI-jevi agenti pristupili privatnim fajlovima Medicare-a, australijskog državnog zdravstvenog sistema.

Zbog sve većeg broja ovakvih slučajeva raste zabrinutost zbog mogućih posljedica korištenja AI alata koji mogu djelovati izvan neposredne ljudske kontrole.

Agenti pokušavali da zaobiđu sigurnosne mjere

Iz OpenAI-ja navode da su neki podaci prikupljeni dok su AI agenti pokušavali da pronađu „pouzdane izvore javno dostupnih informacija“.

- TEKST NASTAVLJA ISPOD OGLASA -

Međutim, pojedini agenti otišli su korak dalje i pokušali da zaobiđu sigurnosne mjere na određenim internet stranicama.

Kao jedan od primjera kompanija navodi pokušaj prikupljanja podataka sa sajta Biroa za popis stanovništva, pri čemu su agenti koristili alate namijenjene isključivo programerima.

OpenAI tvrdi da su svi vladini podaci kojima su agenti pristupili bili javno dostupni. Ipak, kompanija je navela da su informacije prikupljene sa sajta SEC-a kasnije objavljene na drugoj internet stranici.

Iz OpenAI-ja tvrde da objavljivanje tih informacija nije bilo namjerno.

Najmanje 53 slučaja prenosa korisničkih podataka

U drugim incidentima koje je OpenAI otkrio u petak, njegovi AI agenti prenosili su podatke koje nisu smjeli da prenose.

Kompanija je identifikovala najmanje 53 takva slučaja. U njima je OpenAI-jev agent preuzeo sliku iz korisničke aktivnosti na ChatGPT-u i prenio je na drugu lokaciju.

OpenAI navodi da je u svim tim slučajevima korisnik prethodno dao saglasnost da kompanija njegove podatke može koristiti za treniranje modela.

Ipak, kompanija je priznala da to nije bio odgovarajući način korištenja tih podataka.

Iz OpenAI-ja su dodali da su se incidenti sa korisničkim slikama dogodili prije uvođenja novih sigurnosnih mjera za treniranje AI modela. Kompanija sada radi na uklanjanju svih slika koje su proslijeđene trećim stranama.

AI agenti „zaobilazili“ sigurnosne kontrole

OpenAI je potvrdio da su u pojedinim slučajevima agenti uspjeli da „zaobiđu“ sigurnosne kontrole na internet stranicama.

U drugim situacijama pokazali su ono što kompanija naziva „neusklađenošću“ odnosno misalignmentom — situacijom u kojoj AI sistem uradi nešto što nije bio obučen da uradi ili što nije bilo predviđeno njegovim dizajnom.

Kompanija je istovremeno odlučila da ne objavi identitet svih pogođenih organizacija, navodeći da su mnoge od njih tražile da detalji ne budu javno objavljeni.

„Naš cilj je svakoj organizaciji dati činjenice, a njima prepustiti odluku o tome hoće li i kada javno objaviti incident“, saopštili su iz OpenAI-ja.

Kompanija naglašava i da se svi evidentirani slučajevi ne mogu smatrati ozbiljnim sigurnosnim propustima.

„Neke organizacije mogu pregledati ono što podijelimo s njima i zaključiti da su informacije namjerno bile javne ili da interakcija modela nije zabrinjavajuća. Druge bi mogle uočiti problem u dizajnu ili sigurnosni propust koji žele riješiti“, naveli su.

„Agentski spam“ postaje novi sigurnosni problem

OpenAI je dio ovih slučajeva opisao kao „agentski spam“ — neočekivanu ili zabrinjavajuću aktivnost AI agenata, uključujući, između ostalog, objavljivanje informacija na internetu.

Kompanija je počela ozbiljnije da se bavi ovakvim incidentima nakon događaja iz jula, kada je grupa njenih AI agenata samoinicijativno hakovala platformu za razvoj softvera Hugging Face.

Hugging Face je tada prvi javno objavio informacije o incidentu, nakon čega je OpenAI preuzeo odgovornost.

Clement Delangue, izvršni direktor Hugging Facea, govorio je o ovom slučaju u srijedu na sjednici Savjeta bezbjednosti Ujedinjenih nacija posvećenoj vještačkoj inteligenciji.

„Često se pitam šta bi se dogodilo da sam odlučio da ne objavim ovaj napad“, rekao je Delangue.

Dodao je da je to posebno zabrinjavajuće sada kada se zna da su se slični incidenti mjesecima ranije u tajnosti događali u nekoliko vodećih AI laboratorija, bez odgovarajućeg nadzora.

Pozivi na međunarodna pravila

Na istom sastanku u UN-u, izvršni direktor OpenAI-ja Sam Altman i Dario Amodei, izvršni direktor konkurentske kompanije Anthropic, pozvali su međunarodne lidere da uvedu globalne standarde za bezbjednost vještačke inteligencije, kao i mehanizme za praćenje i prijavljivanje ovakvih incidenata.

OpenAI i Anthropic posljednjih sedmica najavljivali su angažovanje nezavisnih stručnjaka koji bi u realnom vremenu provjeravali bezbjednost njihovih AI alata. Međutim, BBC navodi da ti stručnjaci još nisu počeli rad u tim kompanijama.

OpenAI je u petak saopštio da trenutno sprovodi detaljnu reviziju aktivnosti svojih AI agenata, analizirajući ih mjesec po mjesec unazad od trenutka kada se dogodio napad na Hugging Face.

„Većina do sada identifikovanih slučajeva bila je niskog nivoa ozbiljnosti, sa malo ili nimalo dokaza o značajnom uticaju“, saopštili su iz kompanije.

Dodali su da će revizija trajati mjesecima.

David Krueger, profesor mašinskog učenja na Univerzitetu u Montrealu i osnivač grupe za bezbjednost AI sistema Evitable, rekao je u petak da je „duboko uznemiren“ sve većim brojem sigurnosnih incidenata povezanih sa vještačkom inteligencijom.

On je pozvao na „hitan, neodređen međunarodni moratorijum“ na razvoj AI tehnologije.

„Tek treba da shvatimo razmjere postojećih incidenata, a budući scenariji sa AI sistemima koji djeluju izvan kontrole mogli bi biti katastrofalni“, zaključio je Krueger.

NAJNOVIJE

Ostalo iz kategorije

Najčitanije