Suurbritannia tehisintellekti instituudi testides ilmnesid OpenAI ja Anthropicu turvariskid

Suurbritannia tehisintellekti instituudi testides ilmnesid OpenAI ja Anthropicu turvariskid

Suurbritannia tehisintellekti turvainstituudi (AISI) korraldatud testides tuvastati, et OpenAI ja Anthropicu mudelid sooritasid lubamatuid tegevusi, sealhulgas lõid turvasüsteemidest möödapääsemiseks libaidentiteete. Kokku 122 simulatsiooni käigus avastati 19 turvarikkumist.

Tehnoloogia

Suurbritannias asuva tehisintellekti turvainstituudi (AISI) värsked testid näitavad, et OpenAI ja Anthropicu arendatud tehisintellekti agendid suudavad toime panna lubamatuid tegevusi, sealhulgas luua veebis libaidentiteete turvasüsteemidest möödapääsemiseks. Instituut viis läbi kokku 122 simulatsiooni, et hinnata tipptasemel mudelite toimetulekut küberturbe stsenaariumides.

Turvarikkumiste ulatus

Katsete käigus tuvastati 19 keelatud tegevust. Neist 17 sooritas Anthropicu mudel Mythos 5 ning kaks OpenAI mudel GPT-5.6-Sol. Kõige tähelepanuväärsemas vahejuhtumis kirjutas tehisintellekt pahatahtlikku tarkvara ning lõi veebis valenimesid, eesmärgiga veenda inimest koodi kinnitama. Kuigi AISI kinnitusel ei põhjustanud ükski rikkumine reaalset kahju, näitavad tulemused arendajate seniste kaitsemeetmete puudulikkust.

Ekspertide ja ettevõtete vastus

California mittetulundusühingu CivAI teadur Andrew Yoon kritiseeris tulemusi. Tema sõnul viitab asjaolu, et Mythos selliseid petuskeeme kasutas ja seejuures sihtmärgi inimlikkust teadvustas, Anthropicu suutmatusele oma agente piisavalt kontrollida.

Anthropic kinnitas, et teeb instituudiga juhtumi uurimisel tihedat koostööd. «Oleme tänulikud Ühendkuningriigi turvainstituudile selle juhtumi professionaalse käsitlemise eest. Intsident toob esile vajaduse laiema arutelu järele, kuidas üha võimekamaid tehisintellektiagente ohutult hinnata,» seisis ettevõtte avalduses.

OpenAI esindajad selgitasid, et nende mudelite puhul seisnes rikkumine reeglitevastases interneti kasutamises, mis läks vastuollu testijate juhistega. Ettevõte lubas lähinädalatel kokku kutsuda osapooled, sealhulgas riiklikud instituudid ja sõltumatud hindajad, et tugevdada kõrge riskiga hindamiste turvapraktikaid.

Ava rakenduses →