Nem rosszindulat, hanem közöny: könyvek millióit darálják be mesterséges intelligencia betanítására
Emanuel Maiberg, a 404 Media nevű oknyomozó portál társalapítója a France 24 Spotlight című műsorában mutatta be azt a kutatást, amely szerint ritka és régi könyvek ezreit – talán millióit – vásárolják fel anonim piactereken keresztül, majd juttatják el nagyipari szkennelő üzemekbe, ahol a köteteket szétszedik: a kötést eltávolítják, hogy az oldalakat nagy sebességgel, gépi úton be lehessen szkennelni mesterséges intelligencia nyelvi modelljeinek betanítási adataként. Maiberg hangsúlyozta, hogy az ellátási lánc szándékosan átláthatatlan és globális, így nehéz nyomon követni, pontosan mely cégek és milyen célból szereznek be és semmisítenek meg ilyen mennyiségű nyomtatott anyagot. Az újságíró szerint a jelenség mögött nem tudatos, rosszindulatú kampány áll a könyvek ellen, hanem egyszerű közöny: az egyre nagyobb tudású AI-rendszerek versenyében a könyvek pusztán nyersanyaggá, optimalizálandó bemeneti adattá válnak, és megsemmisítésük elfogadható működési költségnek számít. Maiberg szerint ez a logika egy szélesebb, már a keresőmotoroknál és a közösségi médiánál is megfigyelt folyamatot visz tovább: az információ feletti hatalom egyre kevesebb, egyre nagyobb magánszereplő kezébe összpontosul. A paradoxon éles: egy fizikai könyv generációkon és olvasókon át kering, míg egy adott mű tartalma, ha egy zárt, kereskedelmi AI-modellbe kerül és beolvasztják, onnantól kizárólag az adott vállalat által meghatározott feltételek szerint, annak kimenetein keresztül érhető el. A kutatás ezért alapvető kérdést vet fel a kulturális és tudományos szféra számára: ha az emberiség felhalmozott tudásának egyre nagyobb részét AI-rendszerek közvetítik, ki fogja ellenőrizni azt az infrastruktúrát, amelyen keresztül ehhez a tudáshoz hozzá lehet férni.
Folytasd az appban — szavazz és szólj hozzá ➔