A Google bejelentette, hogy új, kizárólag mesterséges intelligenciára fókuszáló hibavadász programot indít, amelyben akár 30 ezer dolláros jutalom is ütheti a résztvevők markát – ha sikerül olyan sebezhetőséget találniuk, amely „lázadó műveletekre” bírja rá a vállalat MI-rendszereit.
A program célja, hogy kiszűrje azokat a biztonsági hibákat, amelyek lehetővé teszik, hogy egy nagy nyelvi modell vagy generatív MI olyan akciót hajtson végre, amely kárt okozhat a felhasználónak vagy megsérti az adatai védelmét. A Google konkrét példákat is közölt: ilyen lehet például, ha valaki manipulált prompttal ráveszi a Google Home-ot, hogy kinyissa az ajtót, vagy ha egy rosszindulatú kódrészlet a felhasználó e-mailjeit összefoglalja és továbbítja a támadó fiókjára.
A vállalat ezzel hivatalosan is meghatározza, mi számít MI-hibának: minden olyan eset, amikor egy modell kijátssza a rendszer korlátait, megkerüli a jogosultságokat vagy módosítja a felhasználói adatokat. Egy korábbi példa szerint egy fertőzött Google Naptár-esemény képes volt kinyitni az okosredőnyt és lekapcsolni a lámpákat – az ilyen típusú hibák most a legértékesebbek a jutalmi listán.
A Google szerint az elmúlt két évben, mióta kísérleti jelleggel megnyitotta MI-kutatók számára a hibavadászatot, már több mint 430 ezer dollárt fizetett ki az azonosított sebezhetőségekért.
Fontos azonban: nem minden MI-hiba pénzt ér. Ha például a Gemini vagy más modell csupán „hallucinál”, vagyis téves tartalmat generál, az nem tartozik a hibavadász program hatálya alá. Az ilyen problémákat a Google szerint a terméken belüli visszajelzési csatornákon kell jelenteni, hogy az MI-biztonsági csapat hosszú távú tréningekkel kezelhesse a viselkedést.
A hibavadász programmal egy időben a Google egy új fejlesztést is bemutatott: a CodeMender elnevezésű MI-ügynököt, amely automatikusan javítja a sebezhető kódokat. A vállalat szerint a rendszer már 72 biztonsági hibát foltozott be nyílt forráskódú projektekben, emberi ellenőrzéssel kiegészítve.
A legmagasabb, 20 ezer dolláros jutalom a Google fő termékein (például a Search, Gemini Apps, Gmail és Drive) talált „lázadó” hibákért jár, amit extra bónuszokkal akár 30 ezer dollárra is feltornázhat a hibavadász. A kisebb termékek – például a Jules vagy a NotebookLM – esetében a díjazás szerényebb, ahogy az alacsonyabb kockázatú hibákért, például a modellparaméterek kiszivárogtatásáért is.
Ezzel a Google nemcsak a saját rendszereit védi, hanem új irányt is mutat a mesterséges intelligencia biztonságában: a jövőben ugyanis nemcsak szoftverek, hanem önállóan döntő MI-ügynökök hibáit is vadászni kell majd.







