Átment a Turing-teszten a ChatGPT, ez emberi intelligenciát sejtet

ChatGPT a Turing-teszten
[Forrás: Midjourney - Justin Viktor]
Tudósok azt állítják, hogy a ChatGPT-4 az első mesterséges intelligencia, amely átment a kétszereplős Turing-teszten. Az MI az esetek 54 százalékában képes volt becsapni az emberi beszélgetőpartnert. 

 

Amióta 1950-ben először alkalmazták, a Turing-teszt sikeres teljesítése az MI-fejlesztések egyik legmagasabb célkitűzésévé vált. A kutatók most azt állítják, hogy a ChatGPT  lett az első olyan mesterséges intelligencia, amely átment ezen a híres intelligencia-teszten.

Alan Turing a számítástechnikai úttörője volt, javaslata szerint egy mesterséges intelligencia akkor tekinthető igazán intelligensnek, ha az emberek nem tudják eldönteni, hogy emberrel vagy géppel társalognak, amikor kommunikálnak vele. A San Diego-i Egyetem kognitív tudósai azzal érvelnek, hogy a ChatGPT-4 az esetek több mint felében képes becsapni a kísérleti alanyokat. A kutatók szerint azonban ez többet mondana el a Turing-tesztről, mint a modern MI intelligenciájáról.

A teszt menete

A kétszereplős Turing-teszt során egy emberi kérdező kérdéseket tesz fel egy MI-nek és egy másik embernek, és kiértékeli a válaszokat. A kérdező nem tudja, melyik partnere ember, illetve MI. Ha a mesterséges intelligencia megtéveszti a kérdezőt, aki azt gondolja, hogy a válaszokat ember generálta, akkor az MI átment a teszten. A kísérlet során a kutatók 500 résztvevőt kértek meg, hogy beszéljenek négy különböző szereplővel: három mesterséges intelligenciával és egy emberrel. A mesterséges intelligenciák a ChatGPT-4 és a ChatGPT-3.5 volt, valamint Joseph Weizenbaum klasszikus ELIZA csevegőprogramja 1960-ból.

A résztvevők öt percig csevegtek, mielőtt megkérdezték tőlük, hogy szerintük számítógéphez vagy emberhez beszélnek és, hogy miért gondolják ezt, illetve, hogy mennyire biztosak benne.  Míg az elavult ELIZA csak az esetek 22 százalékában volt képes becsapni a résztvevőket, a ChatGPT-3.5 a beszélgetések 50 százalékában volt képes erre. A fejlettebb iteráció, a ChatGPT-4 még jobban teljesített, a résztvevők az esetek 54 százalékban embernek minősítették. Ez azt jelenti, hogy a ChatGPT-4 gyakrabban tudja magát embernek kiadni, mint azt a véletlenszerűség megengedné. A kutatók szerint ezek az eredmények „az első robusztus empirikus demonstrációját adják annak, hogy bármely mesterséges rendszer átmegy egy interaktív, kétszereplős Turing-teszten”.

(Azt gondoljuk, hogy ideillik, mit gondolt maga Alan Turing 1950-ben az általa „Imitation Game” néven emlegetett tesztről: „Úgy vélem, hogy körülbelül ötven év múlva lehetséges lesz a jelenleginél milliárdszorosan nagyobb tárolókapacitású számítógépeket úgy programozni, hogy olyan jól játsszák az imitációs játékot, hogy egy átlagos kérdezőnek öt perc után legfeljebb 70 százalék esélye lesz a helyes azonosításra… Úgy vélem, hogy az évszázad végére a szóhasználat és az általános művelt vélemény annyira megváltozik, hogy az emberek beszélhetnek majd gondolkodó gépekről anélkül, hogy ellentmondanának nekik.” 
Továbbá számos MI-szakember a Turing-teszt korlátjának tartja, hogy csak a verbális kommunikációra alkalmazható. Korábban – évekkel a genMI megjelenése előtt – számos MI-alkalmazásról állították, hogy átment a Turing-teszten, ritkán említve meg a siker- vagy kudarc-százalékokat.  – A szerk.)

További tartalmak

Legolvasottabb tartalmak

Strategy

Valós idejű adózás

Human

Az egészség hálózatai

Technology

Egy év, amely átírta az emberiség és a mesterséges intelligencia viszonyát

Strategy

Exportcikk lehet a DÁP-ból

ITBUSINESS heti hírlevél feliratkozás

.
Scroll to Top