# دراسة: استخدام الأطباء لمساعدات الذكاء الاصطناعي يختلف عن الاختبارات المعيارية

> يكشف تحليل 127,833 طلبًا أن معظم الاستخدام الفعلي يتمحور حول التوثيق واسترجاع المعلومات، وهما مجالان لا تغطيهما الاختبارات المعيارية بما يكفي.

Oossa · 2026-10-09 · https://oossa.com/ar/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

فحص باحثون 127,833 طلبًا قدّمها 6,342 طبيبًا وممرضًا وغيرهم من العاملين في الرعاية الصحية إلى مساعد يعمل بنموذج لغوي كبير (LLM) في أحد المستشفيات، على مدى ثمانية أشهر. ووجدوا أن 36 % من الطلبات تعلقت بالتوثيق والأعمال الإدارية، و29 % باسترجاع المعلومات، فيما لم تتجاوز الطلبات المتعلقة بالتشخيص 4 %. كما تعذّر تقديم إجابة جيدة عن أكثر من ثلث الطلبات بصيغتها المطروحة. وعند مقارنة هذه المهام الفعلية بـ58 اختبارًا معياريًا متاحًا للعامة، تبيّن أن الاختبارات غطّت نحو ثلث أنواع المهام فقط، ولم تشمل أعمال التوثيق مطلقًا.

## الحقائق

- 127,833 طلبًا من 6,342 من العاملين في الرعاية الصحية ضمن 35 تخصصًا
- لم تشترك الاختبارات المعيارية مع مهام الاستخدام الفعلي إلا في 31 % منها

## لماذا يهم

قد تحتاج المستشفيات إلى إعادة تصميم تقييمات الذكاء الاصطناعي لتشمل مهام التوثيق والبحث عن المعلومات اليومية التي يعتمد عليها العاملون في الرعاية الصحية فعليًا.

## المصادر والمراجع

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

آخر تحديث: 2026-10-09
