# Onderzoek: artsen gebruiken AI-assistenten anders dan tests voorspellen

> Uit analyse van 127.833 vragen blijkt dat artsen AI in de praktijk vooral gebruiken voor documentatie en het opzoeken van informatie — taken die in benchmarks grotendeels ontbreken.

Oossa · 2026-10-09 · https://oossa.com/nl/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

Onderzoekers analyseerden in acht maanden tijd 127.833 verzoeken aan de grote-taalmodelassistent (LLM) van een ziekenhuis. Die waren afkomstig van 6.342 artsen, verpleegkundigen en andere zorgverleners. Ze ontdekten dat 36 % van de vragen over documentatie en administratie ging en 29 % bedoeld was om informatie op te zoeken; slechts 4 % vroeg om een diagnose. Meer dan een derde van de verzoeken kon niet goed worden beantwoord zoals ze waren geformuleerd. Toen de onderzoekers deze taken uit de praktijk vergeleken met 58 openbare benchmarks, bleken die slechts ongeveer een derde van de soorten taken te omvatten. Documentatiewerk ontbrak er volledig in.

## De feiten

- 127,833 vragen van 6,342 zorgverleners uit 35 specialismen
- Benchmarks omvatten slechts 31 % van de soorten taken uit de praktijk

## Waarom het ertoe doet

Ziekenhuizen moeten AI mogelijk op een andere manier evalueren, zodat ook de dagelijkse documentatie- en informatietaken waarop zorgverleners vertrouwen worden meegenomen.

## Bronnen en referenties

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

Laatst bijgewerkt: 2026-10-09
