Anonüümsuse lõpp: tehisintellekt suudab teie identiteedi rekonstrueerida kahjutute internetijälgede põhjal

Kommentaar filmi, kohviku nime, linna, hobi või elukutse kohta: iseenesest ei paljasta selline teave kuigi palju. Kuid uus uuring näitab, et tehisintellekt suudab selle põhjal koostada üllatavalt täpse digitaalse sõrmejälje.

Teadlased suutsid kasutada ulatuslikke keelemudeleid, et siduda enam kui pooled 987 pseudonüümiga Hacker-Newsi kasutajast nende tegeliku identiteediga. Ilmsed vihjed, nagu isiklikud veebisaidid, sotsiaalmeedia nimed ja GitHubi kasutajanimed, olid eelnevalt eemaldatud.

Katse maksumus: vaid 2000 dollarit ehk üks kuni neli dollarit profiili kohta.

55 protsenti tuvastati – 89 000 kasutaja seast

Teadlased jätsid maha pealtnäha süütut teavet: kolleegide, institutsioonide ja kohalike ettevõtete nimed, elukohad, huvid, demograafilised andmed ja tehnilised oskused.

Tehisintellekt kombineeris selle teabe ja otsis 89 000 kasutaja hulgast sobivaid vasteid. Tulemus: 90-protsendilise täpsusega tuvastati 55,2 protsenti otsitud profiilidest. 99-protsendilise täpsusega tuvastati ikkagi 45,1 protsenti.

Vanem statistiline deanonümiseerimismeetod saavutas samade andmetega vaid 0,1 protsenti.

Oluline erinevus: see, mis varem nõudis aeganõudvat detektiivitööd, saab nüüd tehisintellekti abil automatiseerida ja teostada äärmiselt madalate kuludega.

Mida rohkem sa paljastad, seda lihtsam on tehisintellektil sind leida.

Teine Redditi kasutajatega tehtud katse näitas, et isegi pealtnäha tühine teave filmieelistuste kohta võib aidata kaasa identifitseerimisele. Mida rohkem keegi avaldab, seda unikaalsemaks muutub tema digitaalne profiil.

Teadlased võtavad põhimõtte kokku lihtsalt: linn, elukutse, osaletud konverents või nišihobi kitsendavad kõik võimalike isikute ringi. Kombinatsioonist võib saada ainulaadne sõrmejälg.

Isegi platvormi suurus pakub vaid piiratud kaitset. Teadlaste hinnangul suudaks nende meetod leida miljonist inimesest umbes 45 protsenti ja teoreetilisest 100 miljoni kandidaadi baasist umbes 27 protsenti otsitud isikutest.

Võimas tööriist jälgimiseks

Tagajärjed on märkimisväärsed. Valitsused saaksid selliseid meetodeid kasutada ajakirjanike, dissidentide või aktivistide pseudonüümsete kontode sidumiseks päris inimestega. Ettevõtted ja andmevahendajad saaksid ühendada profiile erinevatel platvormidel.

Selleks ei pea keegi andmebaase häkkima: uuringus kasutati ainult avalikult kättesaadavat teavet, mille kasutajad ise olid avaldanud.

Isegi tehisintellekti süsteemide turvafiltrid võivad pakkuda vähe kaitset. Rünnaku saab jagada pealtnäha kahjututeks ülesanneteks – profiilide kokkuvõtete tegemine, dokumentide võrdlemine, kandidaatide hindamine. Lisaks saab avatud lähtekoodiga mudelite abil kaitsemehhanismid eemaldada.

Digitaalne ID süvendab probleemi

See areng muutub eriti plahvatuslikuks digitaalsete identiteetide ja veebipõhise vanusekontrolli valguses. Tihti lubatakse, et kasutajad saavad oma isikut üks kord tõestada ja seejärel jääda pseudonüümi alla.

Aga kui tehisintellekt suudab juba avaldatud sisu põhjal inimese tuvastada, muutub see eristamine üha hapramaks. Uuring ei tõesta, et digitaalsed ID-d paljastavad automaatselt anonüümseid profiile. Küll aga näitab see, kui kergesti saab hajutatud veebijälgi nüüd kombineerida, et moodustada reaalne identiteet.

Seega ei peitu oht mitte laiaulatuslikus andmevarguses, vaid tuhandetes väikestes detailides, mida inimesed on aastate jooksul vabatahtlikult avaldanud. Varem olid need jäljed laiali üle interneti. Tänapäeval saab tehisintellekt need kõigest mõne dollari eest kokku panna – kuni pseudonüümi taha ilmub pärisnimi.

This site uses Akismet to reduce spam. Learn how your comment data is processed.

Sarnased

spot_img
-Advertisement- spot_img
Leia Meid Youtubes!spot_img

Viimased

- Soovitus -spot_img
- Soovitus -spot_img
- Soovitus -