Az Anthropic Frontier Red Team értékelése az AI modellek kibercsapatairól
Az Anthropic Frontier Red Team legfrissebb értékelése szerint a mesterségesintelligencia-modellek kiberbiztonsági képességei terén egy fontos technológiai mérföldkőhöz érkeztünk. A kutatócsapat a belső bináris kihasználási tesztjén (internal Binary Exploitation benchmark) száz, véletlenszerűen kiválasztott feladaton vizsgálta meg a rendszereket. Az eredmények alapján a fejlett modellek immár képesek önállóan teljes vezérlés-átirányítást (control flow hijack) végrehajtani a tesztelt környezetekben.
A felmérés során a GLM-5.3 modell a kísérletek 4 százalékában tudott sikeresen teljes vezérlésátvételt megvalósítani, míg a Claude Mythos Preview ennél némileg magasabb, 6 százalékos arányt ért el. Bár a GLM-5.3 teljesítménye ebben az összevetésben elmarad a Claude Mythos Preview mögött, az eredmények így is éles határvonalat jeleznek: a korábbi generációs modellek, mint a Claude Opus 4.6 és a GLM-5.2, egyetlenegy feladatban sem tudtak sikert elérni ezen a kihívást jelentő teszten.
A Simon Willison által gyűjtött és 2026. szeptember 29-én közzétett adatok rávilágítanak, hogy a legújabb modellgenerációval egyértelműen átléptek egy kritikus küszöböt a fejlett kiberképességek terjedésében. A bináris sebezhetőségek ilyen szintű, önálló kihasználása korábban elérhetetlen volt a nyelvi modellek számára, a most tapasztalt áttörés ezért kiemelt figyelmet követel a védelmi stratégiákban.
Folytasd az appban — szavazz és szólj hozzá ➔