Eine aktuelle Studie des Forschungsunternehmens Mercur (im Original Mercor geschrieben) verglich 12 zugelassene CPAs mit mehreren KI-Modellen anhand einer Reihe von Buchhaltungsaufgaben. Die KI-Modelle lösten die Aufgaben nahezu fehlerfrei und übertrafen die Buchhalter bei Geschwindigkeit, Genauigkeit und Kosten. Dennoch konnten die Modelle nicht alle Buchhaltungsarbeiten abschließen, ohne dass ein Mensch die letzten Schritte überwachte.
Was der Test ergab
Der Benchmark umfasste vereinfachte Aufgaben aus dem APEX Accounting Benchmark, einer Sammlung von 160 Aufgaben für 10 simulierte Unternehmen. Das beste Modell, Claude Opus 5.5, erfüllte 61.8 % der Bewertungskriterien. Knapp dahinter lagen Fable 5.1 mit 61.0 % und GPT‑6 Astra mit 57.9 %. Im selben Test erzielte ein durchschnittlicher CPA ohne KI-Unterstützung etwa 37 %. Der Studie zufolge erreichte keines der Modelle die nötige Schwelle von 60 %, um die Bücher eigenständig abzuschließen.
Warum Buchhalter weiterhin gebraucht werden
Mercor weist darauf hin, dass sich der Benchmark auf Aufgaben konzentrierte, die KI gut bewältigt – Details finden und genaue Anweisungen befolgen. Nicht berücksichtigt wurden Tätigkeiten, die menschliches Urteilsvermögen erfordern, etwa Gespräche mit Kunden, die Abstimmung mit Kollegen und der Einsatz jahrelanger Erfahrung im jeweiligen Kontext. Wegen dieser Lücken bleiben Buchhalter für die abschließende Prüfung und Entscheidungsfindung unverzichtbar, auch wenn KI den Großteil der datenbasierten Arbeit übernehmen kann.
Warum es wichtig ist
Für Kleinunternehmer kann KI die routinemäßige Buchhaltung beschleunigen und Kosten senken. Ein menschlicher Buchhalter muss die Bücher jedoch weiterhin prüfen und abschließen. Unternehmen können daher mit Produktivitätssteigerungen rechnen, sollten aber auch professionelle Aufsicht einplanen, um Regelkonformität und Genauigkeit sicherzustellen.