Bármilyen számítógépes alkalmazást és weboldalt kezelni képes az Anthropic Claude 3.5 Sonnet MI-modelljének új verziója. Az új funkció gyakorlati előnyei egyelőre homályosak, a veszélyeit viszont még a fejlesztő is elismeri.
Az egyelőre nyílt béta verzióban elérhető Computer Use API tulajdonképpen képes úgy viselkedni, mint egy emberi felhasználó: utánozza a billentyűleütéseket, a kattintásokat és az egérmozgatásokat. Az Anthropic ezzel csatlakozott azon cégek egyre növekvő sorához, amelyek úgynevezett MI-ügynököket, vagyis összetett feladatokat felhasználói parancsra végrehajtani képes megoldásokat dobnak piacra. Legutóbb a Microsoft jelentkezett ilyennel, előtte pedig a Salesforce mutatta be saját megoldását.
A Claude új funkciója úgy működik, hogy a felhasználó először szöveges utasítást ad a modellnek – például azt kéri tőle, hogy a számítógépen és az interneten fellelhető információk alapján töltsön ki egy űrlapot. Az MI-modell megnézi a képernyőképet, abból kiszámolja, hogy hova kell vinni a kurzort a kattintáshoz vagy valamilyen szöveg beírásához. Alkalmas arra is, hogy böngésszen az interneten, így a Claude 3.5 Sonnet bármilyen weboldalt és webes alkalmazást is kezelni tud. Fejlesztője szerint az új verzió képes az önkorrekcióra és újrapróbálkozik a végrehajtással, ha valamilyen akadályba ütközik. Nem jelentenek neki problémát az olyan feladatok sem, amelyek több tucat, vagy akár több száz lépést igényelnek.
Ugyanakkor még az Anthropic is elismeri, hogy a funkció még nem csak a tökéletestől, hanem a megbízhatótól is messze van. Az esetek kevesebb mint felében volt képes újrafoglalni egy repülőjegyet és akkor sem volt sokkal ügyesebb, amikor pénzvisszatérítést kellett volna megoldania. Nehézségei vannak a görgetéssel és a zoomolással, és nem mindig veszi észre a rövid időre felugró értesítéseket, párbeszédablakokat.

Ismerve a jelenlegi MI-modellek hajlamát a tévedésre – valamint sérülékenységeiket a külső behatásokra –, óhatatlanul kétségek fogalmazódnak meg az új funkció biztonságával kapcsolatban is. Az Anthropic szerint mindig a felhasználónál lesz a kontroll: addig és annyi hozzáférést ad az alkalmazásokhoz ameddig és amennyit jónak lát. Ugyanakkor megfelelő támadási módszerekkel már a kevesebbet tudó modelleket is rá lehetett venni káros viselkedésre, például hamis útlevelek megrendelésére a dark webről. A számítógépet emberi módon kezelni képes MI-modell egészen újszerű utakat nyithat a támadók előtt.







