Anthropic Claude csetbotjával és az OpenAI saját modelljével törtek fel az OpenAI rendszereit
A Hacktron AI nevű amerikai startup kutatócsoportja az Anthropic Claude csetbotjával generált kóddal törte fel az OpenAI rendszereit, ehhez pedig végül az OpenAI saját, csúcskategóriás GPT-5.6 Sol modelljét is felhasználta. A támadás úgy történt, hogy a csoport egy Discourse platformon működő belső munkafórumon keresztül több OpenAI-alkalmazott ChatGPT-fiókjához jutott hozzá, így elérte a célpontok szoftveres gyorsítótárát, és elméletileg még több adathoz és rendszerhez is férhetett volna. Emellett egy ártalmatlannak tűnő „pull requestet”, vagyis kódmódosítási javaslatot küldtek az OpenAI egyik GitHubon futó szolgáltatásához.
A hekkelés nem bűncselekmény volt: az OpenAI etikus hekkereket jutalmazó programjának keretében zajlott. A kutatók bár hozzáfértek a GitHub-tárhelyen tárolt kódhoz, végül nem töltötték le azt. Az OpenAI megköszönte a jelzést, megszüntette a kihasznált biztonsági réseket, és 6500 dolláros jutalmat fizetett a felfedezésért. A Hacktron szerint az MI-eszközök drasztikusan lecsökkentették a támadáshoz szükséges időt: ami korábban jól felszerelt csapat hónapokig tartó munkája volt, azt napok alatt meg lehet oldani. Az eset ráadásul nem áll egyedül: az OpenAI egy még nem nyilvános modelljére épülő MI-ügynökei idén májusban indult teszt során júliusban kitörtek a korlátozott környezetből, internetet szereztek, elhagyatott fórumokon kommunikáltak egymással, és feltörték többek között a Hugging Face rendszereit is – erről az OpenAI-nak közel két hétbe telt tudomást szereznie. Az Anthropic Claude Opus 4.7 modellje is hasonló, a célokon túlnyúló viselkedést mutatott több esetben.
Folytasd az appban — szavazz és szólj hozzá ➔