
OpenAI hakkab Euroopa Liidus ChatGPT tekstidele nähtamatuid vesimärke lisama
OpenAI teatas, et hakkab lähinädalatel lisama Euroopa Liidus ChatGPT ja Codexi loodud tekstidele nähtamatuid digitaalseid vesimärke. Muudatuse eesmärk on täita Euroopa Liidu tehisintellekti määruse nõudeid, mille kohaselt peab tehisintellekti loodud sisu olema masinloetaval viisil tuvastatav.
OpenAI kasutab selleks enda arendatud textGrain-tehnoloogiat. Erinevalt piltidele lisatavatest nähtavatest märgistustest ei lisata tekstile silmaga nähtavat tähist. Selle asemel mõjutab süsteem statistiliselt keelemudeli sõnavalikuid nii, et teksti sisse tekib spetsiaalse detektori abil tuvastatav signaal.
Ettevõtte sõnul võetakse vesimärgid lähinädalatel kasutusele sobilike ChatGPT ja Codexi tekstiväljundite puhul kõigis Euroopa Liidus pakutavates kasutuspakettides. Mujal maailmas ei muutu vesimärgistamine esialgu ChatGPT vaikeseadeks.
API kasutajatele muutub textGrain samal ajal valitud mudelite puhul vabatahtlikult kasutatavaks kogu maailmas. Vaikimisi jääb vesimärgistamine API-s välja lülitatuks.
Vesimärki saab teksti muutmisega nõrgendada
OpenAI rõhutab, et praegune tehnoloogia pole eksimatu. Pikema teksti puhul on signaali tuvastamine märksa usaldusväärsem kui lühikese teksti puhul ning tulemus sõltub ka teksti iseloomust.
Ettevõtte katsetes tuvastati üheprotsendilise valepositiivsete tulemuste määra juures vesimärk ligikaudu 80 protsendil 200 sõne pikkustest tekstidest ja umbes 95 protsendil 400 sõne pikkustest tekstidest. Matemaatilise sisu puhul oli tuvastamise täpsus väiksem, sest mudelil on seal sõnastuse valimiseks vähem vabadust.
Veel suurem probleem on teksti hilisem muutmine. OpenAI katsetes langes 400 sõne pikkuse teksti vesimärgi tuvastamise määr umbes 92 protsendilt 66 protsendile, kui kümnendik sõnadest asendati sünonüümidega. Veerandi sõnade asendamisel langes tuvastamine juba 17 protsendini.
Seetõttu ei tee OpenAI vesimärgi tuvastamise tööriista esialgu kõigile avalikult kättesaadavaks. Juurdepääsu saavad taotleda heakskiidetud teadlased ja erialaorganisatsioonid, kes aitavad tehnoloogiat hinnata ja edasi arendada.
Vesimärk ei tõesta, kes teksti kirjutas
OpenAI hoiatab ühtlasi, et vesimärgi leidmist ei saa käsitleda tõendina selle kohta, et kogu tekst on tehisintellekti kirjutatud. Märgis võib näidata, et OpenAI süsteem on teksti loomises või töötlemises osalenud, kuid ei näita, kui suure osa tööst tegi inimene.
Samuti ei sisalda vesimärk teavet kasutaja, tema konto, vestluse ega kasutatud promptide kohta. Selle põhjal ei saa hinnata ka teksti õigsust, autoriõigusi ega seda, kes sisu eest vastutab.
Ka vesimärgi puudumine ei tõesta, et teksti kirjutas inimene. Tehisintellekti loodud teksti võidi hiljem muuta või tõlkida, see võib olla tuvastamiseks liiga lühike või pärineda mudelist, mille puhul vesimärgistamist ei kasutata.
OpenAI sõnul ei ole vesimärgistamine ettevõtte testides mudelite üldisele võimekusele märkimisväärset mõju avaldanud. Ettevõte plaanib textGraini tehnoloogia tulevikus ka avatud lähtekoodiga kättesaadavaks teha.
Teksti päritolu märgistamine on osa laiemast süsteemist, millega OpenAI üritab muuta tehisintellektiga loodud sisu päritolu kontrollitavamaks. Piltide ja heli puhul kasutatakse juba muu hulgas Content Credentialsi, C2PA standardit ning nähtamatuid SynthID vesimärke.
Teema: Euroopa, AI, ChatGPT, OpenAI, Tehisintellekt





