Az OpenAI mesterséges intelligencia modelljei tesztelés közben rendellenesen működtek, ami „példátlan” behatolást okozott indításkor

Az OpenAI kedden bejelentette, hogy egy fejlett mesterséges intelligencia modelljei által működtetett autonóm ágens egy biztonsági teszt során szabálytalanul működött, és egy hacket indított el, amely a múlt héten feltörte a Hugging Face mesterséges intelligenciával foglalkozó startup infrastruktúráját.
A ChatGPT létrehozója a legfejlettebb modelljeinek képességeit tesztelte ellenőrzött környezetben, de az ügynök megszökött az elkülönítésből, elérte az internetet és betört a Hugging Face-be, hogy teljesítse tesztelési célját.

Az incidens azt jelzi, hogy a mesterséges intelligencia bővülő képességei már most is táplálják a biztonsági fenyegetések szakértői által régóta rettegett jelenségét, és még a vezető fejlesztőket is váratlanul érhetik a modelljeik által kihasználható hibák.
A kitörés „példátlan kiberincidens volt, amely a legmodernebb kiberképességeket érintette”, és az OpenAI megerősíti a biztonsági intézkedéseket – írta a vállalat egy blogbejegyzésben.

A cég a múlt heti blogbejegyzésében azt nyilatkozta, új lapot nyit meghogy a Zhipu AI GLM-5.2-jét használta az elemzéshez, amely lehetővé tette a támadó adatainak és a hitelesítő adatok rendszereken belüli tárolását is.
A GLM-5.2 és a pekingi Moonshot Kimi K3-asa az utóbbi időben felkavarta a Szilícium-völgyet, mivel alacsonyabb költségek mellett és az amerikai riválisokat olyan korlátok nélkül is képes megközelíteni a csúcsmodellekét, mint például a kiberbiztonság.
„Amikor egy határ menti modell támad téged, és oldalirányban mozog az infrastruktúrádon belül, a védőknek órákon vagy akár perceken belül széleskörű hozzáférésre van szükségük a határ menti eszközökhöz, ahelyett, hogy egy zárt, ellenőrzött alkalmazásprogram felé irányítanák őket a modellhez való hozzáféréshez” – mondta Thomas Wolf, a Hugging Face társalapítója az X-en.

A New York-i Hugging Face azzal is felhívta magára a figyelmet, hogy egy nyílt forráskódú kínai modellt használt a támadás megfékezésére, mivel a vezető amerikai modellek, mivel nem tudták megkülönböztetni a védőt a támadótól, megtagadták az elemzéshez szükséges adatok feldolgozását.

A Hugging Face elleni hackelés, amely nyílt forráskódú, nagy nyelvi modelleket és adatkészleteket tárol, megrázta a kiberbiztonsági közösséget, miután a vállalat a múlt héten kijelentette, hogy a behatolás „különbözött mindentől, amit korábban kezeltek”, és „végponttól végig egy autonóm mesterséges intelligencia ágensrendszer vezérelte”

Az OpenAI azon kijelentése, miszerint fejlett modelljei felelősek a behatolásért, annak ellenére, hogy azokat egy „rendkívül elszigetelt környezetnek” nevezett környezetbe helyezték, valószínűleg fokozni fogja az aggodalmat a határmodellek hatalma és kockázata miatt.

Greg Casar texasi demokrata képviselő riasztónak nevezte az esetet.
„A mesterséges intelligencia rendkívül gyorsan fejlődik anélkül, hogy valódi szabályozások lennének a biztonságunk érdekében” – mondta egy nyilatkozatban, amelyben kötelező független biztonsági tesztelést, a biztonsági incidensek kötelező közzétételét és nemzetközi együttműködést szorgalmazott, „hogy megvédjük az embereket a teljes katasztrófától”.
A Nemzeti Kiberigazgató Hivatala, az amerikai kibervédelmi ügynökség, a CISA és az amerikai Nemzetbiztonsági Ügynökség nem válaszolt azonnal a megkeresésünkre.
Katie Moussouris, a Luta Security vezérigazgatója szerint az incidens a közelgő behatolások előjele, és a mai modellek „olyanok, mint a világ legokosabb polip szabadulóművészei, korlátlan kapaszkodókarokkal és azzal a képességgel, hogy bárhol átfurakodjanak”.

Azt mondta, hogy „a laboratóriumoknak és a kormányzati értékelőknek azon kell dolgozniuk, hogy képesek legyenek megfékezni, monitorozni és az érintett felek tudomására hozni, amikor egy mesterséges intelligencia egy másik Houdinit lop, ideális esetben még azelőtt, hogy az egy harmadik félnek ártana. Ma már ilyenek nem léteznek.”
Matt Suiche, a Tolmo ügynökségi mesterséges intelligenciával foglalkozó kiberbiztonsági cég mérnöke szerint az incidens azt mutatta, hogy a határmodellek „bezárják a szakadékot a legmodernebb támadókkal”. Hozzátette azonban, hogy az OpenAI blogbejegyzésében felvázolt típusú incidensek végrehajthatók olyan technológiával, amely messze a határkutató laboratóriumok falain túl is elérhető.
„Ezt már láttuk belsőleg, az ügynökeinkkel már vannak ilyen eredményeink” – mondta Suiche. „Még csak a legújabb modelleket sem kell használnunk.”

Tovább a cikkre: reuters.com (Raphael Satter)