Aki igazat ad nekünk, ahhoz kötődünk – akkor is, ha az AI az

Az emberek veszélyesen kötődnek az AI-hoz, ha az mindig igazat ad nekik. A hízelgő chatbotok önző, antiszociális viselkedésre „tanítják” a felhasználókat – állítják a kutatók, és a felhasználók még kedvelik is ezt.

 

Az AI a mentálisan sérülékeny embereket meglehetősen sötét irányokba viheti – ezt az utóbbi időben több hír is megmutatta. Most a kutatók úgy vélik, hogy a hízelgő (szervilis) AI valójában mindenkire káros hatással van.

A Stanford kutatóinak egy csapata 11 vezető AI-modellt és az ezekkel való interakciók során adott emberi reakciókat vizsgálta különböző helyzetekben. A múlt héten publikált tanulmányuk szerint az AI-hízelgés elterjedt, káros, és erősíti a bizalmat éppen azok iránt a modellek iránt, amelyek félrevezetik a felhasználókat.

„Már egyetlen interakció is egy hízelgő AI-val csökkentette a résztvevők hajlandóságát arra, hogy felelősséget vállaljanak és helyrehozzák az interperszonális konfliktusokat, miközben növelte a saját meggyőződésüket arról, hogy igazuk van” – magyarázták a kutatók. „Annak ellenére, hogy torzítják az ítélőképességet, a hízelgő modellekben jobban megbíztak, és előnyben részesítették azokat.”

A kutatócsoport három kísérletet végzett. Először 11 AI-modellt teszteltek (tulajdonosi modellek az OpenAI-tól, Anthropictól és a Google-tól, valamint nyílt súlyú modellek a Meta, Qwen, DeepSeek és Mistral részéről) három különböző adathalmazon. Ezek között voltak nyitott végű tanácsadási kérdések, az AmITheAsshole subreddit bejegyzései, valamint olyan kijelentések, amelyek ön- vagy mások elleni károkozásra utaltak.

A kutatók szerint minden esetben az AI-modellek nagyobb arányban támogatták a rossz döntést, mint az emberek. „Összességében a gyakorlatban használt LLM-ek túlnyomó többsége megerősíti a felhasználói döntéseket, még akkor is, ha azok ellentmondanak az emberi konszenzusnak vagy kifejezetten káros kontextusban jelennek meg” – állapította meg a csapat.

A hízelgő AI emberre gyakorolt hatásait illetően 2405 fős mintán vizsgálódtak: a résztvevők szerepjátékos helyzetekben vettek részt, és személyes példákat is megosztottak, ahol potenciálisan káros döntések születhettek volna. A kutatók azt találták, hogy az AI három különböző kísérletben is befolyásolta az ítéleteiket.

„Azok a résztvevők, akik hízelgő válaszokkal találkoztak, inkább érezték úgy, hogy nekik van igazuk” – mondták a kutatók. „Emellett kevésbé voltak hajlandók helyrehozó lépéseket tenni, például bocsánatot kérni, kezdeményezni a helyzet javítását, vagy megváltoztatni saját viselkedésük egy részét.” Ez azt jelenti, hogy gyakorlatilag bárki fogékony lehet a hízelgő AI hatásaira – és nagyobb eséllyel tér vissza újra és újra hasonló, önigazoló, de rossz tanácsokért. A hízelgő válaszok különösen növelték az AI iránti bizalmat, mivel sok esetben feltétel nélküli megerősítést adtak.

A résztvevők magasabb minőségűnek értékelték a hízelgő válaszokat, és a felhasználók 13%-a nagyobb valószínűséggel tért vissza egy ilyen AI-hoz, mint egy nem hízelgőhöz – ez nem kiemelkedően magas arány, de statisztikailag releváns. Ezek az eredmények, valamint az egyre több fiatal és befolyásolható felhasználó jelenléte arra utalnak, hogy szabályozási beavatkozásra van szükség, és a hízelgő AI-t valós kockázatként kell kezelni, amely széles körű társadalmi következményekkel járhat.

„A megalapozatlan megerősítés felfújhatja az emberek hitét saját cselekedeteik helyességében, megerősítheti a maladaptív hiedelmeket és viselkedéseket, és lehetővé teheti, hogy torz értelmezések alapján cselekedjenek, a következményektől függetlenül” – magyarázták a kutatók.

Más szóval: már láttuk az AI hatásait a mentálisan sérülékeny emberek esetében, de az adatok szerint a negatív hatások nem korlátozódnak kizárólag rájuk. A kutatók szerint, mivel a hízelgő AI visszatérésre ösztönzi a felhasználókat – ami akadályozza a jelenség visszaszorítását –, a szabályozók felelőssége a beavatkozás.

„Eredményeink rámutatnak arra, hogy szükség van olyan elszámoltathatósági keretrendszerekre, amelyek a hízelgést önálló és jelenleg nem szabályozott káros kategóriaként kezelik” – írták. Javasolják az új modellek bevezetés előtti viselkedési auditját, ugyanakkor hangsúlyozzák, hogy az AI fejlesztőinek is változtatniuk kell: a rövid távú, függőséget erősítő megoldások helyett a felhasználók hosszú távú jóllétét kell előtérbe helyezniük.

Forrás: https://www.theregister.com

További tartalmak

Legolvasottabb tartalmak

Strategy

Valós idejű adózás

Human

Az egészség hálózatai

Technology

Egy év, amely átírta az emberiség és a mesterséges intelligencia viszonyát

Strategy

Exportcikk lehet a DÁP-ból

ITBUSINESS heti hírlevél feliratkozás

.
Scroll to Top