Globális mesterséges intelligencia-biztonsági szabványokat javasol az OpenAI
Az OpenAI hétfőn blogbejegyzésben tett közzé javaslatokat a csúcstechnológiás, úgynevezett frontier mesterséges intelligencia biztonságos fejlesztéséről, kiemelten az igazítási (alignment) kutatásra és a rekurzív önfejlesztésre (RSI). A ChatGPT-t készítő cég szerint a biztonságos átmenethez az igazítási kutatásnak lépést kell tartania a képességekkel, hogy a rendszerek az emberi értékekkel összhangban és emberi ellenőrzés alatt maradjanak.
A vállalat nemzetközi együttműködést sürget a frontier szabványok kidolgozására, és azt ajánlja, hogy a munka a világ meglévő mesterségesintelligencia-biztonsági intézeteire épüljön. A műszaki szabványoknak a frontier modellekre és fejlesztőikre kellene fókuszálniuk, valamint az automatizált mesterségesintelligencia-kutatók – köztük az RSI – haszon-kockázat kezelésére. Az RSI vonzereje, hogy az alapmodellek emberi beavatkozás nélkül fejleszthetnék magukat; éppen ezért többen attól tartanak, hogy a készítők elveszíthetik az irányítást, vagy nem számolnak a nem szándélt következményekkel, ahogy a rendszerek bonyolultabbá és az interneten mindennapossá válnak.
Az OpenAI leszögezte: a teljesen autonóm RSI ma nem valóság, és csak akkor szabad követni, ha biztonságosan megoldható. Megfelelő óvatosság nélkül az emberek gyakorlati kontrollt veszíthetnének a fejlesztés fölött, és olyan kutatási folyamatokat sem tudnának felügyelni, amelyeket már nem értenek. A rivális Anthropic a múlt héten saját javaslatait tette közzé; a vitát Jacob Coxon, mindkét cég egykori munkatársa is fűtötte, aki közel két hete lemondott, és azt állította, a vállalatok „az életünkkel játszanak”.
Folytasd az appban — szavazz és szólj hozzá ➔