# Studio: i medici usano l’IA in modo diverso dai test di valutazione

> L’analisi di 127,833 richieste mostra che, nella pratica, l’IA viene usata soprattutto per documentazione e ricerca di informazioni, ambiti in gran parte trascurati dai benchmark.

Oossa · 2026-10-09 · https://oossa.com/it/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

I ricercatori hanno esaminato 127,833 richieste inviate all’assistente basato su un modello linguistico di grandi dimensioni (LLM) di un ospedale da 6,342 medici, infermieri e altri operatori sanitari nell’arco di otto mesi. È emerso che il 36 % delle richieste riguardava documentazione e attività amministrative e il 29 % la ricerca di informazioni, mentre solo il 4 % chiedeva diagnosi. Oltre un terzo delle richieste non era formulato in modo da poter ricevere una risposta adeguata. Confrontando queste attività reali con 58 benchmark pubblici, i ricercatori hanno constatato che i benchmark coprivano solo circa un terzo delle attività e non includevano affatto il lavoro di documentazione.

## I fatti

- 127,833 richieste da 6,342 operatori sanitari di 35 specialità
- I benchmark coprivano solo il 31 % delle attività svolte nella pratica

## Perché conta

Gli ospedali potrebbero dover ripensare la valutazione dell’IA, così da includere le attività quotidiane di documentazione e ricerca di informazioni su cui gli operatori sanitari fanno davvero affidamento.

## Fonti e riferimenti

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

Ultimo aggiornamento: 2026-10-09
