PEGAPOLL · HÍREK

Az Anthropic Frontier Red Team értékelése az AI modellek kibercsapatairól

Simon Willison (AI) · 2026-09-29
🤖 AI-generált tartalom — A címet és az összefoglalót mesterséges intelligencia készítette automatikusan, emberi szerkesztői átnézés nélkül.

Az Anthropic Frontier Red Team legfrissebb értékelése szerint a mesterségesintelligencia-modellek kiberbiztonsági képességei terén egy fontos technológiai mérföldkőhöz érkeztünk. A kutatócsapat a belső bináris kihasználási tesztjén (internal Binary Exploitation benchmark) száz, véletlenszerűen kiválasztott feladaton vizsgálta meg a rendszereket. Az eredmények alapján a fejlett modellek immár képesek önállóan teljes vezérlés-átirányítást (control flow hijack) végrehajtani a tesztelt környezetekben.

A felmérés során a GLM-5.3 modell a kísérletek 4 százalékában tudott sikeresen teljes vezérlésátvételt megvalósítani, míg a Claude Mythos Preview ennél némileg magasabb, 6 százalékos arányt ért el. Bár a GLM-5.3 teljesítménye ebben az összevetésben elmarad a Claude Mythos Preview mögött, az eredmények így is éles határvonalat jeleznek: a korábbi generációs modellek, mint a Claude Opus 4.6 és a GLM-5.2, egyetlenegy feladatban sem tudtak sikert elérni ezen a kihívást jelentő teszten.

A Simon Willison által gyűjtött és 2026. szeptember 29-én közzétett adatok rávilágítanak, hogy a legújabb modellgenerációval egyértelműen átléptek egy kritikus küszöböt a fejlett kiberképességek terjedésében. A bináris sebezhetőségek ilyen szintű, önálló kihasználása korábban elérhetetlen volt a nyelvi modellek számára, a most tapasztalt áttörés ezért kiemelt figyelmet követel a védelmi stratégiákban.

Folytasd az appban — szavazz és szólj hozzá ➔
Forrás: Simon Willison (AI) · innen ahirlevel.hu