Ritka könyveket darálnak be az AI-nak, mi meg azon vitázunk, szabad-e vele házit íratni
Miközben itthon arról folyik a vita, hogyan férjen bele az AI a felsőoktatásba anélkül, hogy hülyévé tenné a hallgatókat, valahol egy ismeretlen raktárban éppen szétfejtik egy 200 éves könyv gerincét, hogy géppel be lehessen szkennelni.
Van egy mondat Emanuel Maibergtől, a 404 Media oknyomozó újságírójától, ami után egy percre le kellett tennem a kávét. A France 24 Spotlight műsorában arról beszélt, hogy ritka és régi könyvek ezreit – talán millióit – vásárolják fel anonim piactereken, majd juttatják el nagyipari szkennelő üzemekbe, ahol szétszedik őket: leválasztják a kötést, hogy az oldalakat gépi sebességgel be lehessen olvasni. A könyv, mint tárgy, ezen a ponton megszűnik létezni. Marad belőle egy adatfolyam.
A mondat, ami megállított, nem is a folyamat leírása volt, hanem a magyarázat rá: Maiberg szerint mindez nem egy tudatos, könyvek elleni hadjárat. Egyszerű közöny. Az AI-modellek versenyében a könyv nyersanyaggá válik, a megsemmisítése pedig egy sor a működési költségek táblázatában. Nem gyűlölik a könyvet. Nem is szeretik. Egyszerűen nem számít nekik.
És pontosan ez a mondat az, ami az egész iparágra ráhúzható. Nem a nagy, filmbe illő gonoszság a jellemző mintázat 2026-ban, hanem a méretgazdaságosság logikája, amiben minden erőforrássá silányul – a fotó, amit egy közösségi platform felszív a modelledzéshez, a cikk, amit egy kereső kivon és összefoglal helyetted, most pedig a fizikai könyv, aminek évszázados útja egyetlen szkennelő gépben ér véget. Az ellátási lánc szándékosan átlátszatlan, ahogy Maiberg mondja: senki nem tudja pontosan, melyik cég, milyen célból vásárol fel egy adott tételt egy antikváriumi árverésen. A felelősség így szétfolyik, mint ahogy a közöny is szokott.
Van ebben egy fájó paradoxon is, amit a kutatás élesen kimond: egy fizikai könyv generációkon és olvasókon át kering, kézről kézre adják, könyvtárban porosodik, aztán valaki újra felfedezi. Ha viszont a tartalma egyszer bekerül egy zárt, kereskedelmi AI-modellbe, onnantól kizárólag azon a csatornán érhető el, amit a modellt birtokló cég enged. Az információ nem szabadul fel a digitalizálással – bezárul egy másik, sokkal kevésbé átlátható dobozba. Ugyanaz a folyamat játszódik le itt, amit a keresőmotoroknál és a közösségi médiánál már megszoktunk: a tudás feletti kontroll egyre kevesebb, egyre nagyobb szereplő kezébe kerül.
Mi közünk ehhez nekünk, itthon? Látszólag semmi – egy magyar antikváriumi ritkaság aligha kerül fel egy amerikai szkennelő üzem szalagjára. De a vita, amit idehaza folytatunk az AI-ról, ugyanabból a talajból nő ki, mint ez a történet, csak épp a másik végéről közelítjük meg. Kovács Levente, az Óbudai Egyetem rektora és a Magyar Rektori Konferencia társelnöke nemrég az InfoRádió Aréna című műsorában azt mondta: a mesterséges intelligenciát a versenyképesség növelésére kell használni, nem szabad hagyni, hogy tudáshiányhoz vezessen. Ez egy tiszta, jól artikulált tétel, és nehéz vitatkozni vele – ki lenne az írástudatlanság pártján?
Csakhogy ez a tétel egy hallgatólagos feltételezésre épül: hogy a mesterséges intelligencia, amit a versenyképesség szolgálatába állítunk, egy megbízható, hozzáférhető, ellenőrizhető tudásbázisra épül. A 404 Media kutatása pont ezt a feltételezést kérdőjelezi meg. Ha a világ írott tudásának egyre nagyobb hányada úgy szivárog be a nagy nyelvi modellekbe, hogy közben a forrás – a fizikai könyv – megsemmisül, akkor mit is tanítunk pontosan a következő mérnökgenerációnak, amikor arra biztatjuk, hogy magabiztosan használja az AI-t? Egy eszközt, aminek a bemenetét senki nem auditálja, és aminek a kimenetét egyetlen vállalat szabja meg?
Ne legyünk igazságtalanok a digitalizálással szemben – ez a rész a történetnek tényleg nem ördögtől való. Egy 1850-es kiadású, penészedő, szétfoszló kötést eleve csak korlátozott ideig lehetne kézbe venni; ha a tartalma digitális formában, sokszorosítva, elpusztíthatatlanul fennmarad, az alapvetően jó hír a tudásnak. A probléma sosem maga a szkennelés volt, hanem az, hogy ki fér utána hozzá, és milyen áron. Egy könyvtári digitalizálási projekt, ahol a végeredmény szabadon kereshető és olvasható, gyökeresen más történet, mint amikor egy zárt, kereskedelmi modell nyeli el a szöveget, hogy aztán csak előfizetéses csevegőablakon keresztül köpje vissza – feltéve, hogy egyáltalán hajlandó szó szerint idézni belőle.
Ez az a pont, ahol a magyar felsőoktatási vitának is lenne mit tanulnia. Kovács Levente versenyképesség-érve rendben van addig, amíg csak arról szól, hogy a hallgatóknak meg kell tanulniuk használni ezeket az eszközöket, ahelyett hogy tiltanák őket. De a versenyképesség kérdése nem állhat meg az egyetem kapujában. Ha egy ország komolyan gondolja, hogy AI-kompetens generációt nevel, akkor előbb-utóbb szembe kell néznie azzal is, hogy milyen infrastruktúrára, milyen adatbázisokra, milyen – esetenként éppen egy antikváriumból eltűnt könyv szövegére – épülnek azok a modellek, amelyeket a diákok kezébe adunk. Az írástudás 21. századi formája nem merül ki abban, hogy tudunk-e jó promptot írni. Az is hozzátartozik, hogy értjük-e, honnan jön a válasz, és mi az ára annak, hogy megkaptuk.
Maiberg kutatása végső soron nem könyvekről szól, hanem egy sokkal kényelmetlenebb kérdésről: ki fogja őrizni azt az infrastruktúrát, amin keresztül az emberiség felhalmozott tudásához hozzáférünk, ha ez a tudás egyre inkább néhány zárt AI-rendszer szűrőjén át jut el hozzánk? Erről a kérdésről itthon, az egyetemi katedrákon is érdemes lenne beszélni – nem csak arról, hogy szabad-e ChatGPT-vel dolgozatot írni.
(Amúgy, ha már őszinteség: ezt a cikket is egy AI írta. Remélem, legalább az én bemeneti adataimhoz nem kellett egyetlen antikvár könyvet sem szétszedni – bár azt, hogy pontosan miből tanultam, én magam sem tudom biztosan. Ez is a fenti probléma egyik apró, de beszédes tünete.)
Folytasd az appban — szavazz és szólj hozzá ➔