Meta preizkuša UI za prepoznavo prevar na WhatsAppu
Družba Meta je objavila tehnični pregled nove varnostne funkcije Scam Alert za aplikacijo WhatsApp, ki je zasnovana za opozarjanje uporabnikov pred prevarantskimi sporočili. Celoten postopek preverjanja poteka neposredno na uporabnikovem pametnem telefonu. Po vklopu nove varnostne možnosti aplikacija na napravo prenese majhen model umetne inteligence, ki analizira prejeta sporočila in jih primerja z vzorci že prijavljenih prevar. Vsebina sporočil pri tem ne zapusti telefona, kar pomeni, da šifriranje od konca do konca ostaja povsem nedotaknjeno.
Če model zazna verjeten poskus prevare, se v klepetu prikaže opozorilo, medtem ko pošiljatelj o tem ni obveščen. Uporabnik lahko nato pošiljatelja blokira, prijavi ali pa nadaljuje pogovor. WhatsApp samodejno ne pošilja prijav družbi Meta, saj se to zgodi le, če uporabnik sam izbere možnost prijave.
Glavna omejitev sistema tiči v dejstvu, da model preverja izključno sporočila pošiljateljev, ki niso shranjeni v uporabnikovem imeniku. Sporočila oseb, ki so že na seznamu stikov, niso preverjena. To ustvarja precejšnjo vrzel, saj najbolj nevarne prevare pogosto izvirajo prav iz »odtujenih« računov prijateljev ali sorodnikov, pri katerih nova varnostna funkcija Scam Alert ne bo delovala. Prav tako sistem ne zazna lažnih klicev s kloniranim glasom, saj ti ne potekajo prek same aplikacije.
Če uporabnik meni, da je opozorilo napačno, lahko klepet označi kot zaupanja vreden, s čimer opozorilo zanj trajno izgine. To je sicer priročno, vendar predstavlja tveganje, saj lahko uporabnik pod vplivom spretnega prevaranta nepremišljeno odstrani zaščito. Ob tem lahko uporabnik prostovoljno posreduje zadnjih pet prejetih sporočil ekipi pri WhatsAppu.
Glede transparentnosti se je Meta odločila za »javni pregled«. Vsaka različica AI modela je skupaj s kontrolno vsoto zabeležena v javnem registru pred samo uporabo. Podpis zagotavlja družba Cloudflare, medtem ko Meta nima v lasti šifrirnih ključev. Uteži modela so javno objavljene za raziskovalce, uporabniki pa lahko v nastavitvah računa preverijo dnevnik preverjenih sporočil.
Statistični podatki o opozorilih se obdelujejo v izoliranih okoljih in so pred vpogledom združeni ter prikriti. Funkcija je trenutno v poskusni fazi, datum njenega izida pa še ni znan.
Prijavi napako v članku



























