Összemérték az MI chatbotokat az emberekkel a kreatív gondolkodást felmérő „alternate uses task” (AUT) tesztben. A kijózanító eredmény szerint az MI chatbotok átlagosan a legtöbb emberi résztvevőt meghaladó kreativitást mutattak. Ugyanakkor öröm az ürömben, hogy a legjobb emberi teljesítmény következetesen felülmúlta a chatrobotokét. Ennek kapcsán közelebbről is megvizsgáljuk a mesterséges intelligencia szerepét az emberi kreatív folyamatok kiegészítésében.
A nagy nyelvi modellekre (LLM-ekre) építő mesterséges intelligencia chatbotok képesek lehetnek tehát felülmúlni az átlagos emberi teljesítményt az olyan kreatív gondolkodási feladatokban, amelyekben a résztvevőknek alternatív felhasználási módokat kellett kitalálni hétköznapi tárgyakhoz (ez a divergens gondolkodás egyik példája) – számolt be róla a Scientific Reports című szaklap.
Divergens gondolkodás
A divergens gondolkodást általában a kreativitással hozzák összefüggésbe, ennek során egy adott feladatra több különböző ötlet vagy megoldás kimunkálását foglalja magában. Mérése általában az alternatív felhasználási feladatokkal (AUT-okkal) történik, amelyekben a résztvevőket arra kérik, hogy rövid időn belül minél több alternatív felhasználási lehetőséget találjanak ki egy hétköznapi tárgyra.
A válaszokat négy különböző kategóriában pontozzák: gördülékenység, rugalmasság, eredetiség, kidolgozottság.
Mika Koivisto és Simone Grassini kutatók 256 emberi résztvevő válaszait hasonlították össze három mesterségesintelligencia-chatbot (ChatGPT3, ChatGPT4 és Copy.Ai) válaszaival, a négy tárgy pedig egy kötél, egy doboz, egy ceruza és egy gyertya voltak.
A chatbot által generált válaszok átlagosan jelentősen magasabb pontszámot értek el az emberi válaszoknál mind a szemantikai távolság (0,95 illetve 0,91), mind pedig a kreativitás (2,91 illetve 2,47) tekintetében. Az emberi válaszok viszont mindkét mérésnél a robotkénál jóval szélesebb skálán mozogtak: a minimális pontszámok sokkal alacsonyabbak voltak, mint a mesterséges intelligencia válaszai esetében, a maximális pontszámok azonban általában magasabbak lettek.
A legjobb emberi válasz a nyolc értékelési kategóriából hétben felülmúlta a chatbotok legjobb válaszát.
Tanulságok
A kapott eredmények azt sugallják, hogy az MI-chatbotok ma már legalább olyan jó kreatív ötleteket képesek generálni, mint egy átlagos ember. A szerzők azonban megjegyzik, hogy csak egyetlen, a kreativitás értékeléséhez kapcsolódó feladatban nyújtott teljesítményt vizsgáltak. A kutatók azt javasolták, hogy a jövőbeli kutatások során azt is vizsgálhatnák, hogy a mesterséges intelligencia hogyan integrálható a kreatív folyamatba az emberi teljesítmény javítása érdekében.








