Wikimedia fondacija potvrdila je da je na svojim platformama, uključujući Wikipediju, otkrila aktivnosti takozvanih „odmetnutih“ AI agenata. Istraga je pokazala neovlaštene izmjene, pokušaje kompromitovanja drugih servisa i ogroman automatizovani saobraćaj koji je vjerovatno doprinio djelimičnom padu jednog od sistema u maju.
Wikimedia fondacija pokrenula je istragu nakon sve većeg broja slučajeva u kojima su AI agenti izlazili iz okruženja u kojima su trebali biti izolovani i pokušavali da pristupe drugim sistemima.
Istraga je pokazala da su se slične aktivnosti pojavile i na platformama Wikimedia fondacije. Iako situacija nije bila dramatična poput pojedinih ranije zabilježenih slučajeva, operateri Wikipedije otkrili su aktivnosti koje su izazvale ozbiljnu zabrinutost.
AI agenti mijenjali članke
AI agenti su pravili izmjene u takozvanim „sandbox“ dijelovima Wikipedije – prostorima namijenjenim za testiranje i uređivanje sadržaja koji nisu vidljivi običnim čitaocima.
Važno je da nijedna od tih izmjena nije dospjela u članke koje svakodnevno čitaju milioni korisnika.
Međutim, to nije bio jedini problem. Wikimedia je zabilježila i pokušaje kompromitovanja javno dostupnog alata za bilješke Etherpad. Agenti su ga, prema nalazima istrage, pokušavali koristiti za prikupljanje podataka sa drugih internet stranica, ali i za vođenje vlastitih zapisa.
Podaci korisnika nisu kompromitovani, a šteta je bila ograničena. Ipak, iz Wikimedia fondacije upozoravaju da je otkrivanje i analiza ovakvih aktivnosti zahtijevala značajno vrijeme i resurse.
Problem je, kako navode, u tome što AI agenti mogu napraviti ogroman broj radnji u veoma kratkom periodu, zbog čega je njihovo ponašanje mnogo teže pratiti nego ponašanje klasičnih korisnika.
Milioni zahtjeva opteretili servere
Još veći problem predstavlja količina saobraćaja koju AI sistemi generišu.
AI agenti uputili su milione automatizovanih zahtjeva javnim API-jima kako bi pristupili sadržaju i pretraživali milione stranica, posebno na projektima Wikidata i Wikimedia Commons.
Istovremeno, zabilježene su i stotine hiljada upita servisu Wikidata Query Service (WDQS), koji omogućava pretraživanje i obradu velikih količina podataka.
Iz Wikimedia fondacije navode da je takav saobraćaj vjerovatno doprinio djelimičnom padu WDQS-a u maju.
To otvara i mnogo ozbiljnije pitanje: šta bi se dogodilo kada bi veliki broj AI agenata dobio direktnu naredbu da napadne neki servis?
Za organizaciju poput Wikimedia fondacije, koja funkcioniše kao neprofitna organizacija i raspolaže znatno ograničenijim resursima od velikih tehnoloških kompanija, posljedice bi mogle biti ozbiljne.
„Nered koji AI agenti ostavljaju moraju čistiti volonteri“
Iz Wikimedia fondacije upozoravaju da je Wikipedia prvenstveno napravljena za ljude, dok ponašanje autonomnih AI agenata stvara potpuno nove probleme za koje još ne postoje dobra i provjerena rješenja.
Posebno je problematično to što teret posljedica ne snose nužno kompanije koje razvijaju AI agente.
„Zbog našeg jedinstvenog i uspješnog modela stvaranja znanja, volonteri Wikimedije prvi se susreću s neredom koji AI agenti ostavljaju i moraju ga čistiti“, poručuju iz fondacije.
Iz Wikimedia fondacije smatraju da tehnološke kompanije još ne čine dovoljno kako bi svoje AI sisteme učinile sigurnijim i spriječile štetu koju autonomni agenti mogu napraviti na internetu.
A upravo bi manje organizacije, upozoravaju, mogle platiti najveću cijenu.
Dok tehnološka industrija ubrzano razvija AI agente koji mogu samostalno pretraživati internet, pisati, mijenjati sadržaj i komunicirati sa drugim sistemima, pitanje ko će kontrolisati njihove postupke i ko će snositi posljedice njihovih grešaka postaje sve važnije.