پژوهش تازهای از شرکت تحقیقاتی Mercur (که در منبع با املای Mercor آمده) عملکرد ۱۲ حسابدار رسمی را با چند مدل هوش مصنوعی در مجموعهای از وظایف دفترداری مقایسه کرده است. مدلهای هوش مصنوعی این وظایف را تقریباً بینقص انجام دادند و از نظر سرعت، دقت و هزینه از حسابداران پیشی گرفتند. بااینحال، مدلها هنوز نمیتوانند بدون نظارت انسان بر مراحل پایانی، مجموعه کامل کارهای حسابداری را انجام دهند.
نتایج آزمون چه بود؟
این آزمون از وظایف سادهشدهای در APEX Accounting Benchmark استفاده کرد؛ مجموعهای شامل ۱۶۰ وظیفه در ۱۰ شرکت شبیهسازیشده. بهترین مدل، Claude Opus 5.5، به ۶۱٫۸٪ از معیارهای ارزیابی دست یافت و پس از آن Fable 5.1 با ۶۱٫۰٪ و GPT‑6 Astra با ۵۷٫۹٪ قرار گرفتند. در همین آزمون، میانگین امتیاز حسابداران رسمی هنگام کار بدون کمک هوش مصنوعی حدود ۳۷٪ بود. پژوهش میگوید هیچیک از مدلها به آستانه ۶۰درصدی لازم برای بستن مستقل حسابها نرسیدند.
چرا هنوز به حسابداران نیاز است؟
Mercor اشاره میکند که این معیارسنجی بر وظایفی متمرکز بود که هوش مصنوعی در آنها عملکرد خوبی دارد؛ مثل یافتن جزئیات و پیروی دقیق از دستورالعملها. بخشهایی از کار که به قضاوت انسانی نیاز دارند، مانند گفتوگو با مشتریان، هماهنگی با همکاران و بهکارگیری سالها دانش زمینهای، در این آزمون لحاظ نشدند. بهدلیل این کاستیها، حسابداران همچنان برای بررسی نهایی و تصمیمگیری ضروریاند؛ حتی اگر هوش مصنوعی بتواند بخش عمده کارهای مبتنی بر داده را انجام دهد.
چرا مهم است
برای صاحبان کسبوکارهای کوچک، هوش مصنوعی میتواند کارهای معمول دفترداری را سریعتر و کمهزینهتر کند، اما همچنان برای بررسی و نهاییکردن حسابها به حسابدار انسانی نیاز است. بنابراین شرکتها میتوانند انتظار افزایش بهرهوری داشته باشند، اما باید برای نظارت حرفهای هم بودجه در نظر بگیرند تا از رعایت مقررات و دقت کار اطمینان حاصل شود.