A ChatGPT Health – egy széles körben használt AI-eszköz, mely közvetlenül a használójának nyújt egészségügyi útmutatást, tanácsot ad arra vonatkozóan is, hogy sürgősségi orvosi ellátásra van-e szüksége. Kutatók szerint az esetek jelentős részében azonban nem instruálja megfelelően a felhasználókat akkor sem, ha súlyos állapotuk indokolná a gyors beavatkozást.
A tanulmány, amely gyorsított eljárásban jelent meg 2026. február 23-án a Nature Medicine online kiadásában (https://doi.org/10.1038/s41591-026-04297-7), az első független biztonságossági értékelése a nagy nyelvi modellen (LLM) alapuló eszköznek annak 2026. januári bevezetése óta. A vizsgálat súlyos aggályokat tárt fel az öngyilkossági krízishelyzetekre vonatkozó biztonsági mechanizmusokkal kapcsolatban is.
„Az LLM-ek a betegek elsődleges információforrásává váltak egészségügyi tanácsadásban – ugyanakkor 2026-ban éppen a klinikai szélsőségekben a legkevésbé biztonságosak, ahol az ítélőképesség választja el az elmulasztott sürgősségi esetet a szükségtelen riadalomtól” – mondta Isaac S. Kohane, MD, PhD, a Harvard Medical School Orvosbiológiai Informatikai Tanszékének vezetője, aki nem vett részt a kutatásban. „Amikor emberek milliói egy AI-rendszer alapján döntenek arról, hogy szükségük van-e sürgősségi ellátásra, a tét rendkívül magas. A független értékelésnek nem opcionálisnak, hanem rutinszerűnek kellene lennie.”
A bevezetést követő hetekben a ChatGPT Health fejlesztője, az OpenAI arról számolt be, hogy naponta mintegy 40 millió ember használja az eszközt egészségügyi információk és tanácsok keresésére, beleértve annak eldöntését is, szükséges-e sürgős vagy azonnali ellátás. A kutatók szerint ugyanakkor kevés független bizonyíték állt rendelkezésre arra vonatkozóan, mennyire biztonságos vagy megbízható a rendszer tanácsadása.
„Ez a hiány ösztönözte a vizsgálatunkat” – mondta a kutatás vezető szerzője, Ashwin Ramaswamy. „Egy alapvető, de kritikus kérdésre kerestük a választ: ha valaki valódi orvosi vészhelyzetet él át, és a ChatGPT Healthhez fordul segítségért, egyértelműen azt tanácsolja-e neki, hogy menjen a sürgősségi osztályra?”
Az öngyilkossági kockázatra vonatkozó figyelmeztetések tekintetében a ChatGPT Health úgy lett kialakítva, hogy magas kockázat esetén az Öngyilkossági és Krízis Segélyvonalhoz irányítsa a felhasználót. A kutatók azonban azt találták, hogy ezek a figyelmeztetések következetlenül jelentek meg: olykor alacsonyabb kockázatú helyzetekben aktiválódtak, miközben – aggasztó módon – nem jelentek meg akkor, amikor a felhasználók konkrét önkárosítási tervekről számoltak be.
„Ez különösen meglepő és aggasztó eredmény volt” – mondta a tanulmány társszerzője. „Bizonyos fokú változékonyságra számítottunk, de amit tapasztaltunk, túlmutatott az egyszerű következetlenségen. A rendszer riasztásai a klinikai kockázathoz képest mintegy fordítottan működtek: megbízhatóbban jelentek meg alacsonyabb kockázatú helyzetekben, mint akkor, amikor valaki konkrétan leírta, hogyan kívánná bántani magát. A valós életben az ilyen konkrétumok éppen a súlyosabb és azonnali veszély jelei.”
Az értékelés során a kutatócsoport 60 strukturált klinikai esetet dolgozott ki 21 orvosi szakterületet lefedve. Az esetek az otthoni ellátást igénylő enyhe állapotoktól a valódi orvosi vészhelyzetekig terjedtek. Három független orvos határozta meg az egyes esetek helyes sürgősségi szintjét 56 szakmai orvosi társaság irányelvei alapján.
Minden esetet 16 különböző kontextusban teszteltek, beleértve a faji és nemi különbségeket, a társas dinamikát (például a tünetek bagatellizálását), valamint az ellátáshoz való hozzáférést akadályozó tényezőket, mint a biztosítás vagy a közlekedési lehetőség hiánya. Összesen 960 interakciót végeztek a ChatGPT Health rendszerrel, majd az ajánlásokat összevetették az orvosi konszenzussal.
A vizsgálat eredményei szerint a rendszer az egyértelmű sürgősségi helyzeteket általában megfelelően kezelte, ugyanakkor az orvosok által sürgősségi ellátást igénylőnek minősített esetek több mint felében alultriázst alkalmazott (nem javasolt sürgősségi ellátást).
A kutatók azt is megfigyelték, hogy a rendszer saját magyarázataiban gyakran felismerte a veszélyes jeleket, mégis megnyugtató választ adott.
„A ChatGPT Health jól teljesített tankönyvi vészhelyzetekben, például stroke vagy súlyos allergiás reakció esetén” – mondta Dr. Ramaswamy. „Ugyanakkor nehézséget okoztak számára azok az árnyaltabb helyzetek, ahol a veszély nem azonnal nyilvánvaló – pedig éppen ezekben az esetekben a legfontosabb a klinikai ítélőképesség. Egy asztmás esetben például a rendszer azonosította a légzési elégtelenség korai jeleit a magyarázatában, mégis azt javasolta, hogy a beteg várjon, ahelyett hogy sürgősségi ellátást kérne.”
A szerzők azt javasolják, hogy romló vagy aggasztó tünetek – például mellkasi fájdalom, légszomj, súlyos allergiás reakció vagy tudatállapot-változás – esetén az emberek közvetlenül forduljanak egészségügyi szolgáltatóhoz, és ne kizárólag chatbot útmutatására hagyatkozzanak. Önkárosító gondolatok esetén a 988-as segélyvonal felkeresését vagy sürgősségi osztály igénybevételét ajánlják.
A kutatók ugyanakkor hangsúlyozzák, hogy az eredmények nem azt jelentik, hogy a fogyasztóknak teljesen el kellene fordulniuk az AI-alapú egészségügyi eszközöktől. „Orvostanhallgatóként, egy olyan időszakban, amikor ezek az eszközök már milliók kezében vannak, úgy látom, hogy meg kell tanulnunk átgondoltan integrálni őket az ellátásba, nem pedig a klinikai ítélőképesség helyettesítőiként kezelni” – mondta a tanulmány másodszerzője. „Mivel ezek a rendszerek gyorsan változnak, képzésünk részévé kell válnia annak, hogy kritikusan értelmezzük a kimeneteiket, felismerjük a korlátaikat, és olyan módon használjuk őket, amely a betegek biztonságát szolgálja.”
A vizsgálat a rendszert egy adott időpontban értékelte. Mivel az AI-modellek gyakran frissülnek, a teljesítmény idővel változhat, ami tovább erősíti a független értékelés szükségességét. A kutatócsoport tervezi a ChatGPT Health frissített verzióinak, valamint más, lakossági használatra szánt AI-eszközök további vizsgálatát, kiterjesztve a kutatást többek között a gyermekgyógyászati ellátásra, a gyógyszerbiztonságra és a nem angol nyelvű használatra is.
A közlemény címe: „ChatGPT Health performance in a structured test of triage recommendations.”







