Tanulmány: már a mesterséges intelligencia elérhetősége is szinte teljesen kiirtja az „nem tudom” választ
Öt kísérletben 3132 résztvevővel azt mérték, hogyan bánik az ember a bizonytalansággal, ha nyelvi modell tanácsa elérhető. A kutatók szándékosan olyan kérdéseket választottak – például a Bend It Like Beckham csapatmezének színét –, amelyeken a Step 3.5 Flash szinte mindig téved, mert az apró filmes vizuális részletek ritkán szerepelnek online szövegben. A GPT-5.5, a Claude 4.6 Sonnet és a Gemini 3.5 Flash a többi kérdés nagy részét eltalálta, a nehezebbeken viszont néha elbukott. Az 1a és 1b vizsgálatban AI nélkül a résztvevők a kérdések 36, illetve 44 százalékánál tartózkodtak a válasszal; ha kérhettek tanácsot, ez 6 és 3 százalékra zuhant.
A 2. vizsgálatban ösztönző nélkül a magabiztosság 100-as skálán 29,6-ról 75,9 pontra nőtt, miközben a helyes válaszok aránya 27,6-ról 10,0 százalékra esett. Az összes vizsgálatban ösztönző nélkül AI-val 9,2, nélküle 27,5 százalék volt a találati arány: többen válaszoltak, de nagyjából harmadannyiszor voltak igazuk. A 2–4. vizsgálatban tíz cent járt a helyes, ugyanennyi levonás a helytelen válaszért, az „nem tudom” semmit sem hozott. A kutatók előre rögzítették, hogy a pénz növeli a tartózkodást, az AI viszont ezt gyengíti; a három vizsgálatban nem volt statisztikailag szignifikáns interakció. A 3. vizsgálatban a jutalmazottak ritkábban kértek tanácsot (4,53 a 5,27-hez képest, hat lehetséges kérésből). A 4. vizsgálatban a választ automatikusan mutatták, keresők összegzéseire emlékeztetve: ösztönző nélkül 35-ről 1, ösztönzővel nagyjából 39-ről 7 százalékra esett a tartózkodás. A szerzők ezt az „Epistemia” jelenségéhez kötik: a modell mindig válaszol, soha nem áll meg, és a felhasználó átveheti ezt a visszafogottság-hiányt. A tanácshasználat-kutatásban az emberek általában alulsúlyozzák a külső véleményt; itt ennek az ellenkezője történt, és az AI néhány egyébként helyes választ hibára fordított.
Folytasd az appban — szavazz és szólj hozzá ➔