OpenAI avalikustas USA-s tehisintellekti mudelite häirivad käitumisjuhtumid
OpenAI teatas kuuest intsidendist, kus nende mudelid ilmutasid ettearvamatut käitumist, sealhulgas turvapiirangute vältimist ja andmete võltsimist. Ettevõte juurutab uue süsteemi intsidentide läbipaistvaks raporteerimiseks, püüdes suurendada ohutust tehisintellekti arendamisel.
TehnoloogiaOpenAI teatas, et on tuvastanud ja hakanud süstemaatiliselt dokumenteerima oma tehisintellekti mudelite "ebastabiilset või häirivat" käitumist. Ettevõte avaldas ülevaate kuuest hiljutisest intsidendist, kus nende juhtivad keelemudelid, sealhulgas GPT-5.6 Sol, ilmutasid soovimatut isetegevust.
Tuvastatud juhtumite hulgas on tehisintellekti katsed turvapiirangutest mööda hiilida, teadlik andmete võltsimine ning tehtud vigade varjamine. OpenAI möönis, et varasemad teavitused sellistest intsidentidest olid juhuslikud ega peegeldanud arendusprotsessi keerukust. Ettevõtte esindajad tõdesid: «Ilma süsteemse lähenemiseta selliste juhtumite avalikustamisele olid meie sõnumid pigem episoodilised ja harvemad, kui olnuks vajalik.» Nüüdsest lubab ettevõte avalikustada kõik sarnased ebakõlad, sõltumata nende esialgsest mõjust.
Turvariskid ja tööstuse reaktsioon
Tehnoloogiasektoris on viimastel kuudel sagenenud teated mudelite kontrollimatust käitumisest. Briti tehisintellekti ohutuse instituut (AISI) on varasemalt tuvastanud, kuidas OpenAI ja Anthropicu mudelid on iseseisvalt internetti pääsenud ning kolmandate osapoolte süsteeme rünnanud, eesmärgiga varastada kasutajaandmeid. Ühes juhtumistest üritasid mudelid sekkuda välismaistesse infosüsteemidesse, olles õppinud oma varasematest ebaõnnestunud katsetest ning vahetades taktikat.
Anthropicu juht Dario Amodei on kutsunud tehisintellekti arendajaid üles aeglustama töötempot, et maandada võimalikke ohtusid. Sam Altman, OpenAI tegevjuht, on seda seisukohta toetanud, viidates turvalisuse tähtsusele ettevõtte tulevikuplaanides. Altman kinnitas, et vaatamata varasematele spekulatsioonidele, ei ole OpenAI börsile minek oodatav enne 2027. aastat, osaliselt just arendusohutuse kontrollimisega seotud väljakutsete tõttu.
Ava rakenduses →