Vještačka inteligencija već danas sve više učestvuje u razvoju novih AI sistema, ali jedno od ključnih pitanja za budućnost jeste šta bi se dogodilo kada bi mašine mogle gotovo potpuno samostalno da treniraju i unapređuju svoje nasljednike.
Na taj scenario upozorava Džared Kaplan, fizičar i jedan od ključnih ljudi Anthropa, kompanije koja razvija modele Claude.
Kaplan govori o mogućnosti „eksplozije inteligencije“, odnosno situaciji u kojoj bi AI sistemi mogli da ubrzavaju sopstveni razvoj brže nego što ljudi mogu da prate njihove sposobnosti i promjene, prenosi Index
Šta je rekurzivno samousavršavanje?
Termin rekurzivno samousavršavanje odnosi se na hipotetički razvoj u kojem AI sistem ne bi samo obavljao zadatke, već bi mogao da učestvuje u dizajniranju, obuci i razvoju nove generacije AI sistema.
Anthropic trenutno upravo istražuje koliko se razvojni proces može delegirati samim AI sistemima. Kompanija navodi da njeni modeli već ubrzavaju rad inženjera, a dugoročni scenario koji proučava podrazumijeva mogućnost da budući AI sistemi sami dizajniraju i treniraju svoje nasljednike. Istovremeno, Anthropic naglašava da do takve pune autonomije još nije došlo i da rekurzivno samousavršavanje nije neizbježno.
Upravo ta mogućnost otvara pitanje koliko bi brzina razvoja mogla biti povećana kada čovjek više ne bi bio usko grlo u procesu stvaranja novih modela.
Kaplan upozorava na moguću „eksploziju inteligencije“
Kaplan smatra da bi potpuno prepuštanje razvoja AI sistemima moglo predstavljati jednu od najvećih tehnoloških prekretnica.
Takav scenario ne znači nužno da bi AI automatski postala neprijateljska prema ljudima. Ključni problem bio bi mnogo širi – koliko bi ljudi mogli razumjeti, kontrolisati i usmjeravati sistem koji je sposoban da sam ubrzava vlastiti razvoj.
U procjenama koje se pripisuju Kaplanu kao mogući period za dolazak do takve prelomne faze pominju se godine od 2027. do 2030., ali riječ je o scenariju i procjeni, a ne o potvrđenoj prognozi kada će se to dogoditi.
Anthropic već koristi AI za razvoj AI
Ono što je nekada bilo teorijsko pitanje danas postaje dio praktičnog istraživanja.
Anthropic navodi da sve veći dio razvoja svojih sistema delegira AI modelima. Prema podacima kompanije, napredak je posebno izražen u programiranju i istraživačkim zadacima. Njihova analiza pokazuje da modeli mogu samostalno izvršavati sve duže i složenije zadatke, uključujući višesatni rad na komplikovanim problemima.
Kompanija je u septembru objavila i nove modele Claude Fable 5.1 i Mythos 5.1, koje opisuje kao svoje najnaprednije modele za programiranje i rad sa znanjem.
Anthropic je 22. septembra predstavio i Claude Opus 5.5, navodeći značajan napredak u rješavanju složenih zadataka i rezultate testiranja koji uključuju vrlo velike softverske projekte.
Gdje počinje problem kontrole?
Najveća zabrinutost koju zagovornici strožeg nadzora ističu jeste mogućnost da sposobnosti AI napreduju brže od mehanizama kojima ljudi provjeravaju šta sistemi rade i zbog čega.
Ako bi jedan sistem mogao da napravi novu verziju sebe, a zatim bi ta nova verzija mogla da napravi još sposobniji sistem, razvoj bi teoretski mogao dobiti potpuno novu dinamiku.
To je razlog zbog kojeg se u stručnim raspravama sve češće govori o potrebi za kontrolom, testiranjem, zaštitnim mehanizmima i nadzorom najnaprednijih modela.
Anthropic je već razvio okvir za procjenu rizika i navodi da radi na dodatnim sigurnosnim mehanizmima za buduće sve sposobnije modele.
Upozorenja dolaze i iz samih AI laboratorija
Rasprava o rizicima nije ograničena na spoljne kritičare tehnoloških kompanija.
Posljednjih mjeseci više istraživača i rukovodilaca iz AI industrije upozoravalo je na pitanja bezbjednosti, posebno u vezi sa razvojem sistema koji mogu samostalno da obavljaju sve veći broj zadataka.
Jedan od primjera je bivši Anthropic istraživač Džejkob Kokson, koji je nakon odlaska iz kompanije javno kritikovao tempo razvoja samousavršavajuće AI. Njegove tvrdnje izazvale su novu raspravu među stručnjacima, pri čemu dio istraživača smatra da rizike treba ozbiljno shvatiti, dok drugi upozoravaju da su scenariji o skorom uništenju čovječanstva pretjerani.
Nije poznato kada bi AI mogla „preuzeti“ sopstveni razvoj
Jedna od najvažnijih činjenica u ovoj raspravi jeste da nema konsenzusa o tome kada bi potpuna rekurzivna samousavršavajuća AI mogla postati stvarnost – niti da li će se takav scenario uopšte ostvariti.
Anthropic u svom aktuelnom istraživanju upravo naglašava tu neizvjesnost: modeli brzo napreduju, ali kompanija istovremeno navodi da puna autonomna izgradnja nasljednika još nije dostignuta.
Zbog toga se period 2027–2030. može posmatrati kao jedna od mogućih vremenskih procjena o kojima se govori u industriji, a ne kao rok do kojeg će se sigurno dogoditi „eksplozija inteligencije“.
Zašto se traži stroži nadzor?
Kako AI sistemi postaju sposobniji, pitanje više nije samo koliko mogu da urade, već i koliko ljudi mogu pouzdano da nadziru njihov rad.
Ukoliko se sposobnosti modela nastave ubrzano povećavati, regulatorima i kompanijama biće potrebno da razvijaju sigurnosne standarde istim tempom.
Upravo zato Anthropic, pored razvoja sve naprednijih modela, paralelno radi na sigurnosti, provjeri ponašanja sistema i metodama kojima bi se moglo dokazati iz kojeg modela potiče određeni rezultat.
Rasprava tako više nije samo pitanje budućnosti. Ona se već vodi unutar samih kompanija koje razvijaju najnaprednije sisteme – i sve više se svodi na jedno pitanje: koliko dugo će čovjek ostati glavni pokretač razvoja vještačke inteligencije?