I ricercatori hanno esaminato 127,833 richieste inviate all’assistente basato su un modello linguistico di grandi dimensioni (LLM) di un ospedale da 6,342 medici, infermieri e altri operatori sanitari nell’arco di otto mesi. È emerso che il 36 % delle richieste riguardava documentazione e attività amministrative e il 29 % la ricerca di informazioni, mentre solo il 4 % chiedeva diagnosi. Oltre un terzo delle richieste non era formulato in modo da poter ricevere una risposta adeguata. Confrontando queste attività reali con 58 benchmark pubblici, i ricercatori hanno constatato che i benchmark coprivano solo circa un terzo delle attività e non includevano affatto il lavoro di documentazione.
Perché conta
Gli ospedali potrebbero dover ripensare la valutazione dell’IA, così da includere le attività quotidiane di documentazione e ricerca di informazioni su cui gli operatori sanitari fanno davvero affidamento.