A kínai Z.ai szerint az új modell a kibervédelmi teszteken megközelíti az Anthropic Mythos 5-ét

A kínai mesterséges intelligencia fejlesztő cég, a Z.ai pénteken bejelentette, hogy nyílt forráskódú GLM-5.3 modellje megközelítette az Anthropic korlátozott Mythos 5 modelljét a szoftveres sebezhetőségek azonosításában, megerősítve ezzel egy kínai mesterséges intelligencia kihívójának reputációját a nyugati fejlesztők körében.
Z.ai szerint a GLM-5.3 84,5%-ot ért el a CyberGym teszten, amely azt vizsgálja, hogy egy modell képes-e áttekinteni a kódot, azonosítani a biztonsági hibákat és megerősíteni azok valódiságát. Ez valamivel magasabb, mint a Mythos 5 esetében jelentett 83,8%. Az eredményeket függetlenül nem ellenőrizték.

A GLM-5.3 lemaradt a Mythos 5 mögött a felfedezett hibák működőképes támadásokká alakításában – ami a védekező biztonsági kutatások standard része. A Z.ai szerint modellje 54,4%-ot ért el az ExploitBench tesztjén ezen a képességen, szemben a Mythos 5 78,0%-ával.

Egy külön időtesztben Z.ai elmondta, hogy a GLM-5.3 két óra alatt 105, hat óra alatt pedig 130 támadásfejlesztési feladatot hajtott végre. A Mythos 5 181, illetve 247 feladatot hajtott végre.

Az Anthropic a Claude Fable 5 modelljének egy, kiberbiztonsági védőintézkedéseket nem tartalmazó változatát, a Mythos-t csak ellenőrzött szervezetek számára tette elérhetővé. Az ilyen ellenőrzések azt az aggodalmat tükrözik, hogy a szoftverhibák felkutatására és kihasználására képes mesterséges intelligencia rendszerek segíthetik a védelmeket, de csökkenthetik a támadók előtt álló akadályokat is.

A Z.ai közölte, hogy a GLM-5.3-at körülbelül két hét múlva teszi közzé nyilvánosan, miután elvégezte a biztonsági felméréseket és megerősítette a védelmeit. A legérzékenyebb kiberbiztonsági funkciói csak az ellenőrzött felhasználók számára lesznek elérhetők egy „megbízható hozzáférés” programon keresztül.
Egy pénteki X-bejegyzésben azt írták, hogy a kezdeti modellhez való hozzáférést megosztják egy kiválasztott indítópartneri csoporttal, amelyet később „következetes és felelősségteljes folyamaton keresztül” bővítenek ki, visszhangozva az Anthropic „Project Glasswing” Mythos korlátozott hozzáférésű programjának nyelvezetét.
„Tudomásom szerint ez az első alkalom, hogy egy kínai laboratórium nyilvánosan biztonsági megfontolásokkal indokolja a modellsúlyok késleltetett nyilvános közzétételét” – mondta Gabriel Wagner, a Concordia AI mesterséges intelligencia-biztonsággal foglalkozó pekingi tanácsadó cég mesterséges intelligencia-irányítási kutatója.

„Ez azt mutatja, hogy a nyílt súlyozású kockázatkezelési gyakorlatok Kínában egyre kifinomultabbá válnak.”
A cég közölte, hogy több védelmi réteget adott a GLM-5.3-hoz, beleértve a kockázatos kérések szűrésére, a modell munkájának figyelésére és a rosszindulatú feladatok elutasítására való betanítására szolgáló rendszereket.
Azt állították, hogy ezeket úgy tervezték, hogy megkülönböztessék a káros tevékenységeket a jogos felhasználásoktól, például a hibák javításától, a kiberbiztonság oktatásától vagy a hivatalos biztonsági teszteléstől.
A kritikusok azonban azt mondják, hogy ezeket a biztosítékokat nehezebb betartatni, ha egy modellt mások is letölthetnek, módosíthatnak vagy külső eszközökkel kombinálhatnak.


A zárt forráskódú mítoszok megszüntetése

Z.ai a Mythos által képviselt korlátozott hozzáférésű modell kihívásaként fogalmazta meg a bevezetést. Azt állította, hogy a fejlett kibervédelmi eszközöknek elérhetőnek kell lenniük a nyílt forráskódú szoftverek fejlesztői és a kisebb biztonsági csapatok számára, ahelyett, hogy korlátozott számú, zárt modellű szolgáltató ellenőrizné azokat.

Azt mondták, hogy elindítanak egy „Nyílt forráskódú pajzs” kezdeményezést, amelynek célja kiválasztott nyílt forráskódú projektek auditálása, modellekhez való hozzáférés biztosítása a védekező munkához, valamint kódauditálási funkciókkal való bővítése a ZCode programozási termékükben.

„Ebben a szellemben Z.ai egyfajta kínai jellemzőkkel rendelkező »Glasswing« javasol, amely a nyitottságot inkább előnynek, mint hátránynak tekinti” – mondta Wagner, utalva a Mythoshoz hozzáférő nyugati vállalatok konzorciumára.

A New York-i székhelyű Hugging Face mesterséges intelligencia startup a múlt hónapban bejelentette, hogy a Z.ai korábbi, GLM-5.2 modelljét használta védekezésre egy ál-OpenAI ügynök által elkövetett kibertámadás ellen , amely betört a rendszereikbe.
A Z.ai nem az első kínai vállalat, amely egy terméket a Mythosra adott válaszként pozicionál. A 360 kiberbiztonsági cég júniusban azt nyilatkozta, hogy Tulongfeng sebezhetőség-felderítő rendszere a Mythoséval egyenértékű képességeket ért el azáltal, hogy mesterséges intelligencia modelleket biztonsági adatokkal és automatizált eszközökkel kombinált, bár ezeket az állításokat nem erősítették meg függetlenül.

A GLM-5.3 abban különbözik ettől, hogy egy általános célú kódolási modell, amelyről Z.ai azt állítja, hogy kibővített utóképzéssel és megerősítéses tanulással szerzett kiberbiztonsági képességeket, nem pedig egy erre a célra épített biztonsági rendszerrel. A vállalat szerint ugyanazt az alapmodellt használta, mint a GLM-5.2, de hosszabb és változatosabb feladatkörnyezetekben képezte ki. A bevezetés a GLM-5.2 iránti globális érdeklődésre épül, amely az elmúlt hónapokban a külföldi fejlesztők körében is felkeltette a figyelmet a kódolási és ügynöki képességei miatt, amelyek a felhasználók és az elemzők szerint megközelítették a vezető amerikai modelleket, de sokkal alacsonyabb áron.

Tovább a cikkre: reuters.com (Eduardo Baptista és Laurie Chen)