Forschende untersuchten 127,833 Anfragen, die 6,342 Ärztinnen und Ärzte, Pflegekräfte und andere Beschäftigte im Gesundheitswesen innerhalb von acht Monaten an den Large-Language-Model-Assistenten (LLM) eines Krankenhauses richteten. Dabei zeigte sich: 36 % der Anfragen betrafen Dokumentation und Verwaltung, 29 % dienten der Informationsbeschaffung und nur 4 % fragten nach Diagnosen. Mehr als ein Drittel der Anfragen ließ sich in der vorliegenden Form nicht gut beantworten. Beim Vergleich dieser Aufgaben aus dem klinischen Alltag mit 58 öffentlich zugänglichen Benchmarks stellten die Forschenden fest, dass diese nur etwa ein Drittel des Aufgabenspektrums abdeckten und Dokumentationsarbeit ganz ausließen.
Warum es wichtig ist
Krankenhäuser müssen die Bewertung von KI möglicherweise neu ausrichten, damit sie die alltäglichen Dokumentations- und Informationssuchaufgaben widerspiegelt, auf die sich Beschäftigte im Gesundheitswesen tatsächlich verlassen.