# Tweetalige AI-audioloog verslaat menselijke experts in blind simulatieonderzoek

> Een onderzoeksteam meldde dat hun AI-systeem, gebouwd met een groot taalmodel en een op regels gebaseerd draaiboek, beter presteerde dan 17 praktiserende audiologen bij 58 gesimuleerde gevallen in het Engels en Chinees.

Oossa · 2026-09-29 · https://oossa.com/nl/bilingual-ai-audiologist-beats-human-experts-in-blind-simulation-study

Onderzoekers publiceerden op 29 september 2026 een artikel over een AI-audioloog die werd getest tegenover echte artsen. De test maakte gebruik van een systeem met gesimuleerde patiënten en 58 gevallen: 30 in het Chinees en 28 in het Engels. De AI scoorde bij elk geval hoger en versloeg alle 17 menselijke audiologen die aan de blinde vergelijking deelnamen.

## Hoe de AI is opgebouwd

Het systeem begint met een algemeen groot taalmodel – het soort AI achter ChatGPT – maar dat model wordt niet verder getraind. In plaats daarvan gaf het team het model een checklist met 21 punten (een beoordelingsrubriek) en stelde het 19 beslisregels op (een ‘draaiboek’), gebaseerd op 73 eerdere audiologiegevallen (43 Engelstalige en 30 Chineestalige). De AI leest ook audiogrammen – grafieken die artsen gebruiken om gehoorverlies weer te geven – en haalt zo nodig externe medische informatie op. Uit een ablatie-experiment bleek dat het draaiboek het meest bijdroeg aan de prestatieverbetering.

## Waarom dit belangrijk is voor patiënten

Als deze aanpak ook buiten simulaties wordt toegepast, kunnen klinieken mogelijk snel tweetalige gehoortests aanbieden, ook op plekken waar weinig gespecialiseerde audiologen zijn. De AI kan routinematige onderdelen van een consult afhandelen, zodat artsen zich kunnen richten op complexe beslissingen en het contact met patiënten.

## De feiten

- Het AI-systeem werd beoordeeld aan de hand van 58 gesimuleerde gevallen (30 Chineestalige en 28 Engelstalige).
- Het presteerde bij elk geval beter dan 17 praktiserende audiologen en scoorde 58/58.
- Het gemiddelde scoreverschil bedroeg +1,35 punten op een samengestelde schaal van 5 punten; Cohen’s d = 1,84 (p = 4,5 × 10⁻²⁰).
- Het systeem gebruikte een beoordelingsrubriek met 21 punten en een draaiboek met 19 regels, gebaseerd op 73 trainingsgevallen (43 Engelstalige en 30 Chineestalige).
- Het artikel werd op 26 september 2026 ingediend bij arXiv en op 29 september 2026 openbaar gemaakt.

## Waarom het ertoe doet

Voor de meeste mensen laat dit zien dat AI basistaken bij gehoortests betrouwbaar kan uitvoeren in zowel het Engels als het Chinees, waardoor zorg mogelijk sneller toegankelijk wordt. AI vervangt geen arts, maar kan specialisten wel meer tijd geven voor de moeilijkste gevallen en persoonlijk contact.

## Bronnen en referenties

1. [A bilingual AI audiologist built through rubric-guided playbook induction outperforms human audiologists in a blinded evaluation of simulated cases](https://arxiv.org/abs/2609.32220) – arXiv, 2026-09-29

Laatst bijgewerkt: 2026-09-29
