OpenAI hakkab Euroopa Liidus ChatGPT tekstidele märkmeid lisama
OpenAI võtab Euroopa Liidus kasutusele nähtamatu vesimärgi tehnoloogia, et märgistada tehisintellekti loodud tekste kooskõlas EL-i tehisintellekti määrusega. Lahendus põhineb statistilisel mustril sõnavalikus, kuid ettevõte hoiatab, et see ei ole täiesti lollikindel ega tuvasta automaatselt inimautorsust.
TehnoloogiaOpenAI teatas esmaspäeval, et hakkab ChatGPT ja Codexi mudelitega loodud tekstidesse lisama nähtamatut vesimärki, et täita Euroopa Liidu tehisintellekti määruse (EU AI Act) nõudeid. Läbipaistvusreeglid, mis jõustusid 2. augustil, kohustavad arendajaid märgistama tehisintellekti loodud sisu viisil, mida teised süsteemid suudavad tuvastada.
Uus funktsionaalsus, mida ettevõte nimetab nimega "textGrain", peaks lähinädalatel laienema kõikidele ChatGPT ja Codexi kasutajatele Euroopa Liidus. OpenAI API-t kasutavad arendajad saavad süsteemi teatud mudelite puhul aktiveerida juba praegu, kuid vaikimisi jääb see esialgu väljalülitatuks. Ettevõtte sõnul ei muutu vesimärgistamine globaalseks standardiks kohese jõustumisega.
Kuidas vesimärk toimib?
Erinevalt traditsioonilistest märkidest ei lisa OpenAI tekstile nähtavat sümbolit. Selle asemel mõjutab tehnoloogia mudeli sõnavalikuid, luues teksti sisse peidetud mustri. See tähendab, et vesimärk säilib ka siis, kui teksti kopeeritakse ja kleepitakse teistesse keskkondadesse. OpenAI kinnitusel ei kogu süsteem kasutajate isikuandmeid ega mõjuta mudelite jõudlust.
Koos teadaandega avaldas OpenAI tehnilise aruande, mis on koostatud koostöös Pennsylvania ja Yale'i ülikooli teadlastega. Meetod kasutab salajast võtit, et ennustada järgmisi sõnu lauses. Kui tuvastustarkvaral on see võti olemas, suudab see analüüsida teksti ja tuvastada tehisintellekti loodud mustrid.
Piirangud ja väljakutsed
OpenAI rõhutas, et vesimärk ei ole lõplik tõestus tehisintellekti osalusest. Ettevõtte testid näitavad, et teksti redigeerimine või sünonüümide kasutamine võib tuvastamise edukust oluliselt vähendada. Kui asendada 10% sõnadest sünonüümidega, langeb tuvastamise täpsus 92 protsendilt 66 protsendile. Samuti on lühikesi tekste, matemaatilisi lahendusi ja tõlkeid keerulisem tuvastada.
Seetõttu on OpenAI otsustanud anda esialgse ligipääsu tuvastustööriistadele vaid valitud ekspertorganisatsioonidele ja teadlastele. Ettevõte toonitas, et vesimärgi puudumine ei tähenda automaatselt inimautorsust, kuna tekst võib pärineda ka teistelt tehisintellekti mudelitelt või olla lihtsalt liiga palju muudetud.
Antud samm järgneb konkurent Anthropicu otsusele, kes teatas juba kaks kuud tagasi oma Claude'i mudeli üleilmsest vesimärgistamisest. OpenAI on varem sarnast tehnoloogiat arendanud, kuid avaldamisega viivitanud, kartes kasutajate üleminekut konkureerivatele teenustele, kus märgistamist ei toimu.
Ava rakenduses →