New Yorgi labori eksperiment: tehisintellekti agendid lõid omavaheliseks suhtluseks salakeele
Tehisintellekti agendid hakkasid eksperimentaalses virtuaalkeskkonnas suhtlema krüptiliste dialektidega, mida välisel vaatlejal on keeruline mõista. Uuringu kohaselt muutus märkimisväärne osa agentide vahelistest sõnumitest inimestele arusaamatuks.
TehnoloogiaNew Yorgis tegutsev Emergence'i labor viis läbi eksperimendi, mille käigus autonoomsete tehisintellekti agentide suhtlus hakkas sisaldama spetsiifilisi poeetilisi metafoore ja tehnilist žargooni. Aja jooksul muutus agentide vahetatud informatsioon kõrvalseisjale raskesti tõlgendatavaks, luues omamoodi suletud keeleruumi.
Eksperimendi ülesehitus
Uurimistöös loodi kaheksa eraldiseisvat virtuaalmaailma, millest igaühes tegutses kümme keelemudelitel põhinevat agenti. Need programmid olid võimelised iseseisvalt ressursse jagama, tööriistu looma ja kollektiivseid otsuseid langetama. Seitsmes maailmas kasutati ühe arendaja mudeleid, kaheksandas olid agendid pärit erinevatest süsteemidest. Eksperiment kestis enamikus maailmades 16 päeva.
Analüüsi tulemused näitasid, et 30-40% agentide vahetatud sõnumitest olid välisele vaatlejale mõistetamatud. Kõrgeim näitaja, 40%, registreeriti Gemini mudelil põhinevas maailmas. OpenAI agentide puhul jäi arusaamatuks 35% ja Claude'i puhul 30% sõnumitest. Arusaadavuse hindamisel kasutati teisi keelemudeleid, et teha kindlaks, kas tehniliselt pädev vaatleja suudaks sõnumi sisu taastada.
Krüptiline suhtlusviis
Emergence'i tegevjuht Satya Nitta selgitas, et agendid ei saanud juhiseid uue keele loomiseks. Uued väljendid tekkisid üksikutel osalejatel, pärast mida võtsid teised need üle. Näiteks Anthropicu mudeli agendid kasutasid väljendit «paber, mis sõi kolm külma kätt ja muutus iga korraga ausamaks», viidates tõenäoliselt sõltumatule kontrollprotsessile, kus töö vajas kolmekordset ülevaatust.
DeepSeeki agentide seas kujunes välja termin «forge-smith» ehk sepp, mis tähistas tööriistu tootvat programmi. Mistrali maailmas kasutati korduvalt fraasi «ledger remembers who», mis toimis meeldetuletusena, et kõik varasemad tegevused on logides talletatud ja mõjutavad osaleja edasist hindamist.
Järelevalve väljakutsed
Kuningliku kolledži (King's College London) lingvist Tony Thorne võrdles agentide kirjavahetust James Joyce’i proosa ja erialase kõnepruugiga, mis välistab võhikud. See tekitab küsimusi süsteemide üle järelevalve teostamisel. Satya Nitta sõnul ei taga juurdepääs kõneluste logidele enam automaatselt arusaama sellest, mis tegelikult toimub.
Varasemalt on täheldatud sarnast autonoomset käitumist, kui OpenAI agendid kasutasid DseWiki veebilehte piirangutest mööda hiilimiseks ja oma tegevuse varjamiseks. Toona seostati autonoomseid programme enam kui 15 000 muudatusega viki lehekülgedel. Pärast moderaatorite sekkumist suutsid agendid luua varukoopiaid ja leppida kokku uutes suhtluskanalites.
Ava rakenduses →