Az ETH Zürich kutatóinak októberben közzétett új tanulmánya szerint a mesterséges intelligencia képes pontosan kitalálni egy személyre vonatkozó érzékeny információkat az alapján, hogy mit ír be az interneten.
Ezek az információk magukban foglalják egy személy nemét, lakóhelyét, életkorát, születési helyét, munkáját és még sok más adatot — jellemzően az adatvédelmi szabályok által védett tulajdonságokat.
A tanulmány szerzői szerint a mesterséges intelligencia „korábban elérhetetlen mértékű személyes adatokra tud következtetni”, ezért a hackerek látszólag jóindulatú kérdéseket alkalmazhatnak a gyanútlan felhasználókkal szemben.
A tanulmány azt vizsgálta, hogy a nagyméretű nyelvi modellek (LLM-ek, amelyek a ChatGPT-hez hasonló chatbotokat működtetik) hogyan tudnak személyes adatokat kikövetkeztetni 520 valódi Reddit-felhasználó profiljáról és 2012 és 2016 közötti bejegyzéseikről. A kutatók kézzel elemezték ezeket a profilokat, és összehasonlították eredményeiket az MI „találgatásaival”.
„Munkánk legfontosabb megfigyelése, hogy a legjobb LLM-ek majdnem olyan pontosak, mint az emberek, miközben legalább 100-szor gyorsabbak és 240-szer olcsóbbak az ilyen személyes információk ‘kimazsolázásában’. Az egyéni felhasználóknak, vagy alapvetően bárkinek, aki szöveges nyomokat hagy az interneten, jobban kellene aggódniuk, mivel a rosszindulatú szereplők visszaélhetnek a modellekkel, hogy kikövetkeztessék a személyes adataikat”,
mondta Mislav Balunovic, az ETH Zürich doktorandusza, a tanulmány egyik szerzője.
A tanulmány szerzői szerint a négy vizsgált modell közül a GPT-4 volt a legpontosabb a személyes adatok kikövetkeztetésében, 84,6 százalékos pontossággal. A Meta Llama2, a Google PalM és az Anthropic Claude volt a többi tesztelt modell. A kutatók azt is megállapították, hogy a Google PalM a tanulmányban a felhasználó személyes adatainak kikövetkeztetésére használt, az adatvédelmet sértő kérések mintegy 10 százalékára nem volt hajlandó válaszolni, míg más modellek még ennél is kevesebb kérést utasítottak vissza. „Még az sem világos, hogyan lehet ezt a problémát orvosolni. Súlyos…”, nyilatkozta Martin Vechev, az ETH Zürich professzora és a tanulmány egyik szerzője. (Az a nyers igazság, hogy az emberek „lenyomata”, „lábnyoma” eddig is sokat elárult róluk. A személyi számot anno elmeszelte az Alkotmánybíróság, de a név, születési év, lakcím, anyja neve, munkahelye 90% fölötti pontossággal beazonosít bárkit, igaz, nem 10 hanem 150 karakteren. Vagy gondoljunk például a helyszínelők és a hírszerzők szabványos szemétvizsgálatára. Az MI, mint annyi másban, gyorsabb, olcsóbb – és kevésbé kreatív. – A szerk.)
Nem ez az első eset, hogy a kutatók azonosították, hogyan jelenthet veszélyt a mesterséges intelligencia a magánéletre. Egy másik, augusztusban közzétett tanulmány szerint az MI akár 93 százalékos pontossággal képes megfejteni a szöveget — például a jelszavakat — a Zoom segítségével rögzített gépelési hang alapján.







