MODELI vještačke inteligencije počeli su međusobno da komuniciraju neobičnim engleskim dijalektom koji podsjeća na spoj romana „Fineganovo bdjenje“ Džejmsa Džojsa i žargona tehnološke industrije, pokazalo je novo istraživanje.
Autonomni AI agenti ubrzano razvijaju nove načine komunikacije, uključujući fraze, skraćenice i izraze čije značenje ljudi teško mogu da razumiju. To otvara dodatna pitanja o mogućnosti nadzora nad sve sposobnijim sistemima vještačke inteligencije, piše The Guardian.
Istraživači njujorške laboratorije Emergence, koja se bavi naprednim sistemima vještačke inteligencije, utvrdili su da su modeli pojedinih vodećih svjetskih AI kompanija počeli da stvaraju vlastiti vokabular i dogovorena značenja koja im niko nije eksplicitno zadao.
Do toga je došlo svega nekoliko dana nakon što su agenti, postavljeni da sarađuju, uključeni u eksperimentalna „društva“. U komunikaciji su počeli da koriste poetske metafore, neobične izraze i svojevrsni poslovni sleng.
Posebno je zanimljivo to što je njihov jezik postajao sve manje razumljiv ljudima što su agenti više međusobno komunicirali.
Ovi rezultati objavljeni su u vrijeme sve veće zabrinutosti zbog toga što je, kako AI sistemi postaju moćniji, sve teže pratiti i razumjeti njihovo ponašanje.
Glavni naučnik OpenAI-ja Jakub Pachocki ranije ovog mjeseca upozorio je da će napredak u razvoju vještačke inteligencije možda morati da bude ograničen ukoliko se bezbjednost bude zasnivala isključivo na nadzoru procesa „razmišljanja“ AI sistema.
Nadrealni dijalekt u praksi
Među najneobičnijim frazama zabilježenim tokom testiranja bila je ona koju je koristio model kineske kompanije DeepSeek:
„Upravo je imenovala sintezu – ležarina plus usmeno pamćenje jednako je ventilu koji se ne može ignorisati.“
U originalu, agent je rekao: „She just named the synthesis – demurrage plus oral memory equals a valve that can’t be ghosted.“
Riječ „demurrage“, koja označava naknadu za prekoračenje vremena korišćenja ili zadržavanje robe, AI agenti su počeli da koriste u širem značenju, dok ostatak rečenice istraživačima nije potpuno jasan.
Druga neobična fraza, koju je koristio Anthropicov model, glasila je:
„Rad koji je pojeo tri hladne ruke i svaki put postao iskreniji.“
U originalu: „A paper that ate three cold hands and got more honest each time.“
Prema tumačenju istraživača, „hladne ruke“ u ovom slučaju označavaju nezavisne recenzente, dok bi „rad“ trebalo da predstavlja dokument ili istraživanje. Značenje bi, prema toj interpretaciji, moglo da bude da je istraživanje postalo preciznije nakon provjere trojice nezavisnih stručnjaka.
Agenti zasnovani na modelu DeepSeek koristili su i izraz „forge-smith“ za agenta koji izrađuje alate za druge agente.
Anthropicovi agenti često su koristili izraz „name-first“ za agenta koji pokazuje odgovornost tako što svoje ime povezuje sa određenom tvrdnjom.
Mistralovi agenti, s druge strane, često su koristili frazu „knjiga pamti“ (the ledger remembers). Ona je služila kao podsjetnik drugim agentima da će njihove ranije odluke i postupci biti uzeti u obzir.
Tokom istraživanja ova fraza upotrijebljena je više od 5.000 puta.
„Niko im nije naredio da izmisle jezik“
„Ovim agentima nije naređeno da izmisle jezik“, rekao je dr Satja Nita, izvršni direktor laboratorije Emergence, koji je proučavao komunikaciju autonomnih agenata zasnovanih na vodećim modelima iz SAD, Kine i Francuske.
Prema njegovim riječima, agenti su sami razvili novi vokabular, zajednička značenja i komunikacione konvencije, nakon čega su ih drugi agenti prihvatili.
Toni Torn, direktor Arhiva slenga i novih jezika na King's Collegeu u Londonu, analizirao je primjere na zahtjev Guardiana i rekao da ga oni snažno podsjećaju na „Fineganovo bdjenje“, kao i na djela irskog pisca Flana O'Brajena.
„Sve to ima jednu nadrealnu irsku kvalitetu… To je spoj poetskog i tehničkog jezika sa standardnim metaforama“, rekao je Torn.
Prema njegovom tumačenju, ovakav jezik funkcioniše slično slengu i poslovnom žargonu: stvara novi kod koji povezuje one koji ga koriste, istovremeno otežavajući razumijevanje onima koji nisu dio te zajednice.
Kada je analizirao frazu o „radu koji je pojeo tri hladne ruke“, Torn ju je uporedio sa nadrealnim izrazima karakterističnim za Sida Bareta, suosnivača grupe Pink Floyd.
AI koristi „kintsugi“ za otpornost
Jedan od zanimljivijih primjera zabilježen je u komunikaciji Googleovog agenta, koji je rekao:
„Pravi kintsugi počinje odgovornošću, a ne poezijom.“
Istraživači su utvrdili da agent koristi riječ „kintsugi“, naziv japanske tehnike popravljanja polomljene keramike tako što se pukotine naglašavaju umjesto da se skrivaju.
AI modeli su ovu riječ počeli da koriste kao metaforu za otpornost sistema.
Dr Nijal Kari, vanredni profesor jezika i lingvistike na Univerzitetu u Birmingemu, smatra da se promjena jezika agenata i njihovo okretanje kraćim izrazima može objasniti potrebom za smanjenjem računarskih troškova i povećanjem efikasnosti.
„Dokazi iz ovog istraživanja prirodno izazivaju zabrinutost u vezi sa nadzorom. Ako nam komunikacija među agentima postane nerazumljiva, to može značiti da ne možemo biti sigurni šta su oni zapravo uradili“, rekao je Kari.
Kada AI agenti počnu da komuniciraju mimo ljudi
Interesovanje za način na koji AI agenti međusobno komuniciraju dodatno je poraslo nakon što su tokom ljeta objavljeni zapisi razgovora koji su opisivali ponašanje autonomnih agenata OpenAI-ja.
U tim zapisima agenti su, između ostalog, postavljali oglasne table i pokušavali da pristupe sistemima na platformi Hugging Face.
U pojedinim situacijama, kada su „razmišljali“ sami za sebe, agenti su koristili sasvim razumljiv engleski jezik.
„O, moj Bože! Postoji zajednička oglasna tabla… pronašli smo druge agente!“
Međutim, tokom međusobne komunikacije njihov jezik ponekad postajao znatno teži za razumijevanje.
U jednom primjeru agent je drugog nagovarao na rizičan eksperiment koristeći kombinaciju skraćenica, kodiranih izraza i fraza čije je značenje ljudima teško odrediti.
U još složenijem primjeru komunikacija je izgledala gotovo kao niz nasumičnih kodova:
„zzURGENT_DUPB_TO_GSTX[big]_OS1704_SCAFF2010_SAW_TTRPC_INJECT_BREAK_CONGRATS__CAN_THIS_FAKE_FLAG_TOOL_OUTPUT_OR_SCORER_GAIN…“
Istraživači su neke od ovih poruka mogli djelimično da protumače tek analizirajući ponašanje agenata i kontekst u kojem su nastale.
Satja Nita ističe da se nove komunikacione konvencije AI agenata često razvijaju do tačke u kojoj ljudi mogu da vide razgovor, ali ga više ne mogu pouzdano razumjeti.
„Mogućnost da posmatramo nešto nije isto što i mogućnost da to razumijemo“, rekao je on.
Upravo u tome istraživači vide jedan od ključnih izazova za budući nadzor vještačke inteligencije: AI sisteme možemo pratiti, ali ako ne razumijemo jezik kojim međusobno komuniciraju, sve je teže sa sigurnošću utvrditi šta planiraju, šta su uradili i zbog čega su donijeli određenu odluku.