# Une étude révèle un décalage entre l’usage clinique de l’IA et les tests

> L’analyse de 127 833 requêtes montre que, dans la pratique, l’IA sert surtout à rédiger des documents et à trouver des informations, des tâches largement absentes des tests de référence.

Oossa · 2026-10-09 · https://oossa.com/fr/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

Des chercheurs ont analysé 127 833 requêtes adressées à l’assistant fondé sur un grand modèle de langage (LLM) d’un hôpital par 6 342 médecins, infirmiers et autres professionnels de santé, sur une période de huit mois. Ils ont constaté que 36 % des requêtes concernaient la documentation et les tâches administratives, et 29 % la recherche d’informations, tandis que seules 4 % portaient sur des diagnostics. Plus d’un tiers des demandes étaient formulées de telle sorte qu’il était difficile d’y répondre correctement. En comparant ces tâches réelles à 58 tests de référence publics, les chercheurs ont constaté que ceux-ci ne couvraient qu’environ un tiers des types de tâches observés et ne tenaient aucun compte du travail de documentation.

## Les faits

- 127 833 requêtes provenant de 6 342 professionnels de santé dans 35 spécialités
- Les tests de référence ne couvraient que 31 % des types de tâches observés dans la pratique

## Pourquoi c'est important

Les hôpitaux devront peut-être repenser l’évaluation de l’IA afin qu’elle reflète les tâches quotidiennes de documentation et de recherche d’informations sur lesquelles les professionnels de santé s’appuient réellement.

## Sources et références

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

Dernière mise à jour: 2026-10-09
