MI az ember ellen, itt a legújabb összecsapás eredménye

Összemérték az MI chatbotokat az emberekkel a kreatív gondolkodást felmérő „alternate uses task” (AUT) tesztben. A kijózanító eredmény szerint az MI chatbotok átlagosan a legtöbb emberi résztvevőt meghaladó kreativitást mutattak. Ugyanakkor öröm az ürömben, hogy a legjobb emberi teljesítmény következetesen felülmúlta a chatrobotokét. Ennek kapcsán közelebbről is megvizsgáljuk a mesterséges intelligencia szerepét az emberi kreatív folyamatok kiegészítésében.

 

A nagy nyelvi modellekre (LLM-ekre) építő mesterséges intelligencia chatbotok képesek lehetnek tehát felülmúlni az átlagos emberi teljesítményt az olyan kreatív gondolkodási feladatokban, amelyekben a résztvevőknek alternatív felhasználási módokat kellett kitalálni hétköznapi tárgyakhoz (ez a divergens gondolkodás egyik példája) – számolt be róla a Scientific Reports című szaklap.

Divergens gondolkodás 

A divergens gondolkodást általában a kreativitással hozzák összefüggésbe, ennek során egy adott feladatra több különböző ötlet vagy megoldás kimunkálását foglalja magában. Mérése általában az alternatív felhasználási feladatokkal (AUT-okkal) történik, amelyekben a résztvevőket arra kérik, hogy rövid időn belül minél több alternatív felhasználási lehetőséget találjanak ki egy hétköznapi tárgyra.

A válaszokat négy különböző kategóriában pontozzák: gördülékenység, rugalmasság, eredetiség, kidolgozottság.

Mika Koivisto és Simone Grassini kutatók 256 emberi résztvevő válaszait hasonlították össze három mesterségesintelligencia-chatbot (ChatGPT3, ChatGPT4 és Copy.Ai) válaszaival, a négy tárgy pedig egy kötél, egy doboz, egy ceruza és egy gyertya voltak.

MI az ember ellen - kinek jobb a kreativitása?
[Forrás: Stephanie Arnett (MITTR) via Midjourney]
A szerzők a válaszok eredetiségét a szemantikai távolság (a válaszban felvetett metódus távolsága a tárgy eredeti használatának módjától) és a kreativitás alapján értékelték. Számítógépes módszerrel, egy 0-tól 2-ig terjedő skálán számszerűsítették a szemantikai távolságot, az emberi értékelők pedig, akik nem ismerték az éppen értékelt válaszok forrásait, szubjektíven 1-5-ig értékelték a kreativitást.

A chatbot által generált válaszok átlagosan jelentősen magasabb pontszámot értek el az emberi válaszoknál mind a szemantikai távolság (0,95 illetve 0,91), mind pedig a kreativitás (2,91 illetve 2,47) tekintetében. Az emberi válaszok viszont mindkét mérésnél a robotkénál jóval szélesebb skálán mozogtak: a minimális pontszámok sokkal alacsonyabbak voltak, mint a mesterséges intelligencia válaszai esetében, a maximális pontszámok azonban általában magasabbak lettek. 

A legjobb emberi válasz a nyolc értékelési kategóriából hétben felülmúlta a chatbotok legjobb válaszát.

Tanulságok

A kapott eredmények azt sugallják, hogy az MI-chatbotok ma már legalább olyan jó kreatív ötleteket képesek generálni, mint egy átlagos ember. A szerzők azonban megjegyzik, hogy csak egyetlen, a kreativitás értékeléséhez kapcsolódó feladatban nyújtott teljesítményt vizsgáltak. A kutatók azt javasolták, hogy a jövőbeli kutatások során azt is vizsgálhatnák, hogy a mesterséges intelligencia hogyan integrálható a kreatív folyamatba az emberi teljesítmény javítása érdekében.

További tartalmak

Legolvasottabb tartalmak

Strategy

Valós idejű adózás

Human

Az egészség hálózatai

Technology

Egy év, amely átírta az emberiség és a mesterséges intelligencia viszonyát

Strategy

Exportcikk lehet a DÁP-ból

ITBUSINESS heti hírlevél feliratkozás

.
Scroll to Top