# Araştırma: Klinik çalışanları yapay zekâyı testlerden farklı kullanıyor

> 127.833 sorgunun incelendiği analiz, gerçek kullanımın çoğunun belge hazırlama ve bilgi aramaya yönelik olduğunu; kıyaslama testlerinin ise bu görevleri büyük ölçüde gözden kaçırdığını gösteriyor.

Oossa · 2026-10-09 · https://oossa.com/tr/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

Araştırmacılar, 6.342 doktor, hemşire ve diğer sağlık çalışanının sekiz ay boyunca bir hastanenin büyük dil modeli (LLM) asistanına yönelttiği 127.833 isteği inceledi. Sorguların yüzde 36’sının belge hazırlama ve idari işlerle, yüzde 29’unun bilgi edinmeyle ilgili olduğunu; yalnızca yüzde 4’ünün teşhis talep ettiğini buldular. İsteklerin üçte birinden fazlası, yöneltildiği biçimiyle iyi yanıtlanabilecek nitelikte değildi. Araştırmacılar bu gerçek dünyadaki görevleri 58 açık kıyaslama testiyle karşılaştırdığında, testlerin görev dağılımının yalnızca yaklaşık üçte birini kapsadığını ve belge hazırlama işlerini tümüyle dışarıda bıraktığını gördü.

## Gerçekler

- 35 uzmanlık alanında çalışan 6.342 klinisyenden 127.833 sorgu
- Kıyaslama testlerinin kapsadığı görev dağılımı, gerçek kullanımdaki dağılımla yalnızca yüzde 31 oranında örtüşüyordu

## Neden önemli

Hastanelerin yapay zekâ değerlendirmelerini, klinisyenlerin günlük hayatta gerçekten yararlandığı belge hazırlama ve bilgi arama görevlerini yansıtacak şekilde yeniden tasarlaması gerekebilir.

## Kaynaklar ve referanslar

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

Son güncelleme: 2026-10-09
