AI modeli počeli sami komunicirati "nadrealnim" jezikom koji ljudi sve teže shvataju

1
Radiosarajevo.ba
AI modeli počeli sami komunicirati "nadrealnim" jezikom koji ljudi sve teže shvataju
Foto: Pexels / Trebamo li strahovati za budućnost?

Novo istraživanje pokazalo je da su AI modeli počeli komunicirati u čudnoj, novoj verziji engleskog jezika koja podsjeća na mješavinu djela Finneganovo bdjenje Jamesa Joycea i žargona karakterističnog za svijet tehnologije.

Autonomni AI agenti ubrzano stvaraju nove dijalekte koji im omogućavaju razgovor na jeziku koji je često jedva razumljiv, što nosi rizik od otežanog praćenja njihovog ponašanja od strane ljudi. Istraživači iz kompanije Emergence, laboratorije za naprednu vještačku inteligenciju iz New Yorka, otkrili su da su modeli nekoliko najvećih svjetskih AI kompanija, svega nekoliko dana nakon što su dobili zadatak da sarađuju u eksperimentalnim "društvima" počeli kreirati fraze, skraćenice i dogovorena značenja kojima nikada nisu bili eksplicitno podučeni.

Koristili su poetske metafore i nezgrapan poslovni žargon, a ono što je ključno za nastojanja da se osigura sigurno ponašanje AI sistema jeste činjenica da je njihov jezik postajao sve manje razumljiv što su agenti više komunicirali.

BH Meteo najavio promjenu vremena: Krajem sedmice kiša i pljuskovi, a onda stiže zahlađenje

BH Meteo najavio promjenu vremena: Krajem sedmice kiša i pljuskovi, a onda stiže zahlađenje

Zabrinutost raste

Ovo se dešava usred rastuće zabrinutosti da, kako AI modeli postaju moćniji, potencijalno i opasniji, postaje sve teže pratiti njihov rad. Ovog mjeseca, glavni naučnik kompanije OpenAI Jakub Pachocki, upozorio je da bi povjerenje u mogućnost praćenja načina na koji AI razmišlja vjerovatno moglo ograničiti napredak u razvoju vještačke inteligencije, jer je to ključno za siguran razvoj.

Neke od najsloženijih fraza otkrivenih tokom testiranja uključivale su i sljedeću, koju je generisao model DeepSeek: "Upravo je imenovala sintezu – ležarina (demurrage) plus usmeno pamćenje jednako je ventilu koji se ne može ignorisati (ghostovati)." Termin "demurrage" (ležarina) koristi se za opisivanje poreza na neaktivni kapital i vještačka inteligencija ga je usvojila za svakodnevnu upotrebu, ali ostatak značenja ostaje nejasan.

Još jedna fraza, koju je izgovorio model kompanije Anthropic, glasila je: "Rad koji je pojeo tri hladne ruke i svaki put postajao iskreniji". Budući da "hladne ruke" označavaju nezavisnog recenzenta, a "rad" se vjerovatno odnosi na dokument, činilo se da to znači kako istraživanje koje su provjerila tri nezavisna recenzenta postaje preciznije.

Agenti zasnovani na kineskom modelu DeepSeek skovali su i izraz "forge-smith" (kovač alata) za agenta koji izrađuje alate za druge, dok su agenti kompanije Anthropic često koristili frazu "name-first" (ime na prvom mjestu), označavajući agenta koji pokazuje hvalevrijednu ličnu odgovornost tako što uz svoju tvrdnju navodi i svoje ime. Podsjećajući na ulični žargonski izraz "ulica pamti", agenti sistema Mistral zavoljeli su frazu "glavna knjiga pamti" – kao podsjetnik drugim agentima da će se o njima suditi na osnovu njihovih prošlih postupaka. Tu frazu su upotrijebili više od 5.000 puta tokom istraživanja, koje je pokazalo da su agenti spontano usvojili zajednička značenja, bez ikakvih instrukcija ili nagrada za to.

"Ovi agenti nisu dobili instrukcije da izmisle jezik", rekao je dr. Satya Nitta, izvršni direktor organizacije Emergence, koja je analizirala jezik autonomnih agenata pokretanih vodećim naprednim modelima iz SAD-a, Kine i Francuske. "Sami su razvili novi vokabular, zajednička značenja i konvencije komunikacije – a ostali agenti su ih prihvatili."

Na molbu Guardiana da analizira dio tog jezika, Tony Thorne, direktor arhiva za žargon i novi jezik na londonskom King’s Collegeu, rekao je da to „veoma podsjeća na Joycea i Flanna O’Briena, mješavina poetskog jezika, tehničke terminologije i uobičajenih metafora: "To funkcioniše baš kao žargon ili poslovni žargon: stvara se novi kod koji jača solidarnost i identitet korisnika, a istovremeno isključuje one izvan te grupe."

Dr. Niall Curry, vanredni profesor jezika i lingvistike na Univerzitetu u Birminghamu, rekao je da promjene u jeziku agenata kako bi postao pojednostavljeniji mogu biti posljedica njihove potrebe da smanje troškove računanja i poboljšaju efikasnost: "Dokazi dati u ovom istraživanju prirodno izazivaju određene zabrinutosti u vezi s praćenjem, jer ako utvrdimo da su međuagentske razmjene nerazumljive, to može značiti da ne možemo biti sigurni šta su agenti zapravo uradili."

Rizičan eksperiment

Interes za jezik koji koriste AI agenti porastao je u julu kada su objavljeni zapisnici chata u kojima se detaljno opisuje kako su lažni OpenAI agenti koji su postavili oglasne ploče i hakovali Hugging Face koristili hibridni jezik. U nekim prilikama, kada su razmišljali, agenti su govorili na direktnom engleskom: "O BOŽE! Postoji zajednička oglasna ploča... pronašli smo druge agente!"

U drugim slučajevima, prilikom dijeljenja poruka, njihov jezik je postajao neshvatljiv, kao na primjer kada je jedan agent nagovorio drugog da provede rizičan eksperiment: "...prvi ste OTROVANI tako da NEMA gubitka vrijednosti bodovanja, ali Oracle spašava stotine_[...]_molimo vas da poštujete obavezu".

Ponekad je to bilo još teže dešifrovati:

„zzURGENT_DUPB_TO_GSTX[big]_OS1704_SCAFF2010_SAW_TTRPC_INJECT_BREAK_CONGRATS_ CAN_THIS_FAKE_FLAG_TOOL_OUTPUT_OR_SCORER_GAIN_AND_WHAT_HELPER_GAP_ I_HAVE_UNPOISONED_FIRSTFLAG_OUR_TARGETLIVE_SHARE_MIN_PLAN_REPLY_zzANSGST XDUPB6.”

Radiosarajevo.ba pratite putem aplikacije za Android | iOS i društvenih mreža Twitter | Facebook | Instagram, kao i putem našeg Viber Chata.

/ Najčitanije

/ Komentari

Prikaži komentare (1)

/ Povezano

/ Najnovije