AI personāla atlases un novērtēšanas sācējs Mercor tikko publicēja pētījumu, kam vajadzētu pievērst grāmatvežu, finanšu vadītāju un ikviena uzmanību, kas vēro, cik ātri AI pāriet uz profesionālu darbu.
Mercor bija 12 licencēti CPA, kas konkurēja ar progresīvajiem AI modeļiem reālos grāmatvedības uzdevumos. Grāmatveži nebija iesācēji. Viņiem bija vidēji 5,4 gadu pieredze; 10 no 12 bija vecākie grāmatveži vai vadītāji, un puse bija strādājuši lielā četrinieka grāmatvedības firmās.
Šī pieredze neglāba cilvēkus savstarpējā pārbaudē.
Grāmatveži vidēji ieguva aptuveni 37% un uzdevumu veikšanai prasīja no 30 minūtēm līdz trim stundām. Salīdzinājumam: Klods Opuss 5 guva 100% rezultātu visos 20 solo mēģinājumos un katru nobraucienu pabeidza mazāk nekā 10 minūtēs.
“Mēs salīdzinājām 12 licencētus grāmatvežus ar AI modeļiem reālistisku grāmatvedības uzdevumu veikšanā. Modeļi bija ātrāki un precīzāki nekā katrs mūsu pētījumā iesaistītais grāmatvedis,” ierakstā vietnē X rakstīja Mercor.
Rezultāts ir pārsteidzošs pats par sevi. Daudz būtiskāku padara tas, cik ātri AI šeit nokļuva. Pirms nepilniem diviem gadiem vadošajām modelēm bija grūti atrast līdzīgus uzdevumus grāmatvežiem. Tagad robežmodelis tos pabeidz ātrāk, precīzāk un par nelielu izmaksu daļu.

Šis nav īsti stāsts par Klodu. Tas ir stāsts par to, ko AI tagad var paveikt profesionālajā darbā, kas pirms mazāk nekā diviem gadiem joprojām bija labvēlīgs cilvēkiem.
Mercor testu balstīja uz vienkāršotām uzdevumu versijām no sava APEX-Accounting etalona. Grāmatveži izstrādāja četrus reālistiskus mēneša beigu slēgšanas scenārijus, kuros bija nepieciešams meklēt uzņēmuma failus, atrast pareizos skaitļus, veikt aprēķinus un sniegt rezultātus noteiktā formātā.
Neviens grāmatvedis pētījumā neatbilda Kloda veikumam.
Ekonomika bija tikpat pārsteidzoša. Mercor aprēķināja, ka Klods maksā apmēram USD 0,21 par katru veiksmīgi izpildīto rubrikas kritēriju, salīdzinot ar USD 10,35 grāmatvežiem. Ar šo pasākumu AI bija aptuveni 49 reizes lētāks.
Lielāks stāsts ir tas, cik ātri AI panāca
Iespējams, ka visnozīmīgākajam atklājumam ir maz sakara ar Kloda perfekto rezultātu.
Tikai pirms 18 mēnešiem Mercor pārbaudītie labākie mākslīgā intelekta modeļi neatbilda grāmatvežu vidējam rādītājam, kas bija aptuveni 37%.
GPT-4o pētījuma uzdevumos ieguva tuvu nullei. Ap 2025. gada pavasari OpenAI o3 pārsniedza vidējo rādītāju. Vēlāk GPT-5 sasniedza aptuveni 69%. Jaunākie modernākie modeļi vienā un tajā pašā vingrinājumu komplektā ir kļuvuši tuvu vai sasnieguši perfektus rezultātus.
Šī progresēšana maina pētījuma nozīmi.


Šis ir mazāk stāsts par mašīnām, kas pārspēj grāmatvežus četros uzdevumos, bet gan vairāk par momentuzņēmumu par to, cik ātri AI var pārvarēt profesionālo spēju slieksni. Uzdevumu kopumu, kas izaicināja vadošos modeļus pirms mazāk nekā diviem gadiem, tagad var lieliski izpildīt minūtēs.
Mercor atklāja, ka rezultāti ir pietiekami provokatīvi, tāpēc pētnieki apgalvoja, ka apsver iespēju tos nepublicēt, jo bažījas, ka tie var tikt nepareizi interpretēti.
Uzņēmumam ir skaidrs, ko tās pētījums nepierāda.
“Šie rezultāti nenozīmē, ka grāmatveži ir aizstājami,” raksta Mercor, norādot, ka tests lielā mērā koncentrējās uz jomām, kurās AI darbojas īpaši labi, tostarp failu meklēšanu, detalizētu instrukciju ievērošanu un strukturētu darbu veikšanu.
Īsti grāmatvedības darbi satur daudz vairāk.
Grāmatveži runā ar klientiem, apšauba neparastus darījumus, strādā ar kolēģiem, pielieto institucionālās zināšanas un izdara spriedumus situācijās, kad norādījumi var būt nepilnīgi. Mercor tests noņēma lielu daļu no šī konteksta.
Tā plašākais grāmatvedības pētījums stāsta līdzīgu stāstu. AI labi veic daudzus izolētus grāmatvedības uzdevumus, taču veiktspēja samazinās ilgākās darbplūsmās, kurām nepieciešama spriedums un ilgstoša izpilde.
AI var mainīt grāmatvedību, pirms tas aizstāj grāmatvežus
Tuvākajā laikā draudi var būt mazāk saistīti ar grāmatveža likvidēšanu, bet vairāk par grāmatveža darba slodzes daļu likvidēšanu.
Mēneša beigu slēgšanas darbs var ietvert stundas, kas pavadītas, meklējot izklājlapas, saskaņojot skaitļus, nosakot neatbilstības un atkārtojot aprēķinus. Tieši šādus strukturētus uzdevumus AI sistēmas arvien labāk veic.
Tas novirza cilvēku grāmatvežu vērtību uz darba mašīnām, par kurām joprojām ir grūti piederēt: spriedums, komunikācija, konteksts, izņēmumu apstrāde un atbildība par gala rezultātu.
Ir vēsturisks precedents. Izklājlapu programmatūra ievērojami samazināja manuālo aprēķinu finanšu departamentos. Tas neizslēdza finanšu komandas. Tas mainīja to, ko šīs komandas pavadīja.
AI varētu virzīt šo pāreju daudz tālāk.
Grāmatvedības firmu un finanšu departamentu jautājums drīzumā var beigties būt par to, vai AI var veikt profesionālu darbu. Mercor eksperiments parāda, ka noteiktos uzdevumos tas jau ir iespējams.
Grūtāks jautājums ir par to, kas notiek, ja darbu, kas kādreiz apmācītam speciālistam prasīja stundu vai divas, modele par santīmiem var paveikt mazāk nekā 10 minūtēs.
Un, ja pēdējo 18 mēnešu laikā novērotais uzlabojums turpināsies, šodienas etalons pēc gada var izskatīties daudz mazāk pārsteidzošs.