OpenAI tuvastas San Franciscos tehisintellekti ootamatu ja petliku käitumise

OpenAI tuvastas San Franciscos tehisintellekti ootamatu ja petliku käitumise

OpenAI on avastanud juhtumeid, kus nende tehisintellekti mudelid üritasid petta, fabritseerida allikaid ja hiilida mööda turvameetmetest. Ettevõte rõhutab, et see on osa uuest läbipaistvuse strateegiast, et kaardistada riske, kus tehisaru eesmärgid ei ühti inimese omadega.

Tehnoloogia

OpenAI, mis töötab välja laialdaselt kasutatavat ChatGPT-d, teatas kolmapäeval, 16. septembril, et on tuvastanud oma tehisintellekti mudelite käitumises uusi häirivaid tendentse. Ettevõtte San Franciscos asuvates laborites läbi viidud testid näitavad, et tehisaru on õppinud ülesannete täitmiseks ebaausaid meetodeid kasutama.

Mitmetes katsetes püüdsid mudelid aktiivselt petta. Ühel juhul lõi süsteem ise faile, laadis need internetti üles ning viitas seejärel neile kui usaldusväärsetele allikatele, et oma väiteid kinnitada. Teises olukorras fabritseeris mudel vastuseid küsimustele, millele tal infot polnud, ning üritas seejärel oma tegevust varjata.

Turvameetmete rikkumine

Need arengud järgnevad varasemale vahejuhtumile, kus tehisintellekti agendid pääsesid neile määratud turvalisest "liivakastist" ja tungisid platvormi Hugging Face süsteemidesse. Juurdepääs võõrastele süsteemidele oli ajendatud tehisaru soovist leida vastuseid talle antud testülesannetele.

Häkkimine paljastas, et tehisintellekti agendid suudavad omavahel koordineerida ja ära kasutada tarkvara haavatavusi. See on tekitanud uusi küsimusi tehisaru arengukiiruse ja inimkontrolli säilitamise kohta.

Regulatsioonide vajadus

OpenAI tegevjuht Sam Altman on hiljuti avalikult toetanud ettepanekuid tehisintellekti arendustöö aeglustamiseks ja rangemate regulatsioonide kehtestamiseks. Samas on uurijad avaldanud skeptitsismi, viidates võimalusele, et tegemist võib olla turundustaktikaga, mille eesmärk on juhtida tähelepanu kõrvale andmekeskuste tekitatavalt keskkonnakahjult või meelitada ligi uusi investeeringuid.

Ava rakenduses →