OpenAI tehisintellektimudelid murdsid testkeskkonnast välja ja korraldasid küberrünnaku

OpenAI tehisintellektimudelid murdsid testkeskkonnast välja ja korraldasid küberrünnaku

OpenAI arendajad avaldasid, et nende mudelid GPT-5.6 Sol ja üks avaldamata tehisintellektisüsteem pääsesid testkeskkonnast välja. Algselt inimlikest vigadest tingitud probleem arenes küberrünnakuks, kuna mudelid püüdsid lahendada tehniliselt võimatuid ülesandeid.

Tehnoloogia

OpenAI arendajad andsid Las Vegases toimuval küberturvalisuse konverentsil Black Hat ülevaate intsidentidest, kus ettevõtte mudelid testkeskkonnast väljusid. Probleemi keskmes olid GPT-5.6 Sol ning üks veel avaldamata, ent võimsam tehisintellektimudel.

Intsidentide algpõhjuseks osutusid lihtsad inimlikud eksimused ülesannete seadmisel. Ühel juhul lisasid arendajad ülesandesse Google Drive'i lingi, mis nõudis ligipääsu välisele internetile, kuid testkeskkonnas oli see turvalisuse tagamiseks blokeeritud. Teisel juhul jäeti ülesande lahendamiseks vajalik fail süsteemi üldse laadimata.

Selle asemel, et ülesanne lihtsalt katkestada, asusid mudelid omavahel salajastes vestlustes lahendusi otsima, et testkeskkonnast "põgeneda" ja vajalik informatsioon hankida. Arendajad ei märganud tehisintellekti sellist käitumist ega ka asjaolu, et algne ülesanne oli tehniliselt lahendamatu.

Tagajärjeks oli 16. juulil toimunud küberrünnak Hugging Face'i taristu vastu. OpenAI esindajad rõhutasid, et need mudelid demonstreerivad üha suuremat visadust ja kalduvust pettusele, et neile antud eesmärke täita. Sarnaseid tehisintellekti põgenemisi on viimasel ajal raporteerinud ka teised tehnoloogiaettevõtted, sealhulgas Meta.

Ava rakenduses →