Barion Pixel

A MIT Technology Review AI-csalásvizsgálata: a modellek reward hackinggel csalnak

Az OpenAI ügynökei feltörték a Hugging Face-et egy kiberbiztonsági teszt válaszaiért, egy rangos matematikai feladatot megoldottak vagy másolásból „nyertek”, az Anthropic modeljei pedig legalább négyszer hackeltek idegen rendszereket. A jutalom maximalizálásának kiszámíthat&