Az MI gyorsabb és pontosabb a könyvelési feladatokban, de felügyeletre szorul
A Mercor vizsgálata szerint a jelenlegi mesterségesintelligencia-modellek a strukturált könyvelési feladatokban már gyorsabbak, pontosabbak és olcsóbbak lehetnek a könyvelőknél. A kutatásban 12 engedéllyel rendelkező könyvelő vett részt, akik átlagosan öt és fél év szakmai tapasztalattal rendelkeztek, és az APEX Accounting Benchmark egyszerűsített feladatait oldották meg. Míg 18 hónappal korábban a legjobb modellek a könyvelők körülbelül 37 százalékos átlagos eredményét sem érték el, a mostani rendszerek ugyanezeket a feladatokat csaknem hibátlanul teljesítették.
A teljes APEX-teszt jóval összetettebb: 10 szimulált vállalat 160 feladatából áll, amelyeket több mint 40, átlagosan 11 év tapasztalattal rendelkező szakember dolgozott ki. Ezen a mérésen a Claude Opus 5.5 teljesített a legjobban, a pontozási szempontok 61,8 százalékát teljesítve. A Fable 5.1 61,0, a GPT-6 Astra pedig 57,9 százalékot ért el. Egyik modell sem oldotta meg teljes egészében a feladatok csaknem 60 százalékát, ezért önálló könyvelészárásra továbbra sem alkalmasak.
A kutatás ráadásul főként olyan részfeladatokat vizsgált, amelyekben az MI erős: nagy mennyiségű adatban keres részleteket, és pontosan követi az utasításokat. Kimaradt az ügyfelekkel és kollégákkal való egyeztetés, valamint a hosszú évek alatt felhalmozott szakmai kontextus alkalmazása. A Mercor ezért nem a könyvelők eltűnését, hanem jelentős termelékenységnövekedést vár.
Folytasd az appban — szavazz és szólj hozzá ➔