Az EU-ban vízjelezi a ChatGPT szövegeit az OpenAI, de a globális API-felhasználóknak nem lesz kötelező
Az Európai Unió mesterségesintelligencia-szabályozásához (EU AI Act) igazodva az OpenAI a következő hetekben láthatatlan vízjelezést vezet be a ChatGPT és a Codex felületein az uniós felhasználóknak. A textGrain nevű technológia statisztikai mintát ágyaz a modell szóválasztásaiba. Eltérően az Anthropic Claude-jától – ahol a vízjelezés globálisan kötelező –, az OpenAI az API-ügyfelek számára világszerte, így a Microsoft Azure felhőben is választhatóvá teszi a funkciót, magát a technológiát pedig nyílt forráskódúvá tervezi tenni.
A detektálás hatékonysága nagyban függ a szöveg hosszától és típusától: 1 százalékos téves riasztási arány mellett egy 400 tokenes pszichológiai mintánál 95 százalékos volt a felismerés, 200 tokennél 80 százalékra esett, matematikai témáknál pedig jóval alacsonyabb maradt. A védelem ráadásul könnyen kijátszható: a szavak 10 százalékának szinonimára cserélése 66 százalékra, míg negyedük átírása 17 százalékra rontotta a detektálást.
Az OpenAI az Astra modellen végzett benchmarkok (például a GPQA Diamond és DeepSWE) alapján közölte, hogy a vízjel nem rontja a modell teljesítményét. A detektorhoz az uniós magatartási kódex alapján egyelőre csak kijelölt kutatók férhetnek hozzá. Az eszköz kizárólag a vízjel meglétét jelzi, felhasználói adatokat vagy promptokat nem azonosít.