Az OpenAI egy olyan eszközt fejlesztett, amely képes lehet felismerni a diákok csalását, ha azok a ChatGPT-t kérik meg házi feladatuk megírására, azonban a The Wall Street Journal szerint a cég még mérlegeli, hogy valóban kiadja-e.
Az OpenAI szóvivője megerősítette, hogy a cég a szöveges vízjelezési módszert kutatja, ahogy azt a Journal cikke leírta. Azonban „szándékos megközelítést” alkalmaznak a módszer kiadása előtt, figyelembe véve annak bonyolultságát és a szélesebb ökoszisztémára gyakorolt hatását az OpenAI-n túl.
„A szöveges vízjelezési módszer, amit fejlesztünk, technikailag ígéretes, de fontos kockázatokkal jár, amelyeket mérlegelünk, miközben alternatívákat kutatunk. Ilyen kockázat például, hogy a rosszindulatú felhasználók kikerülhetik, valamint hogy aránytalanul érintheti az olyan csoportokat, mint a nem angol anyanyelvűek”,
mondta a szóvivő.
Ez a megközelítés különbözne a korábbi, mesterséges intelligencia által generált szövegek felismerésére tett kísérletektől, amelyek többnyire hatástalanok voltak. Az OpenAI maga is leállította korábbi MI-szövegdetektorát az alacsony pontosság miatt.
A szöveges vízjelezéssel az OpenAI kizárólag a ChatGPT által generált szövegek felismerésére koncentrálna, más cégek modelljei által létrehozott szövegekre nem. Ez úgy működne, hogy apró változtatásokat végezne a ChatGPT szóválasztásain, lényegében láthatatlan vízjelet hozva létre az írásban, amit később egy külön eszköz észlelhet.
A Journal cikkének megjelenése után az OpenAI frissítette a májusi blogbejegyzését az MI által generált tartalom felismerésére irányuló kutatásáról. A frissítés szerint a szöveges vízjelezés nagyon pontosnak bizonyult, és hatékony a helyi szintű módosítások ellen, mint például a parafrázis. Azonban kevésbé ellenálló a globális módosításokkal szemben, mint például a fordító rendszerek használata, átfogalmazás egy másik generatív modellel, vagy speciális karakterek beillesztése a szavak közé, majd ezen karakterek törlése.
Ennek eredményeként az OpenAI szerint ez a módszer „triviálisan kijátszható a rosszindulatú felhasználók által.” Az OpenAI frissítése visszhangozza a szóvivő azon állítását is, hogy a szöveges vízjelezés megbélyegezheti az MI-t, mint hasznos íróeszközt a nem angol anyanyelvűek számára.







