# Estudo mostra que médicos usam assistentes de IA de forma diferente dos testes de referência

> Análise de 127,833 consultas mostra que a maioria dos usos no dia a dia envolve documentação e busca de informações — tarefas pouco contempladas pelos testes de referência.

Oossa · 2026-10-09 · https://oossa.com/pt/study-finds-clinicians-use-ai-assistants-differently-than-benchmark-tests

Pesquisadores analisaram 127,833 solicitações feitas ao assistente de modelo de linguagem de grande porte (LLM) de um hospital por 6,342 médicos, enfermeiros e outros profissionais de saúde ao longo de oito meses. Eles constataram que 36 % das consultas eram sobre documentação e tarefas administrativas, e 29 % envolviam busca de informações, enquanto apenas 4 % pediam diagnósticos. Mais de um terço das solicitações não podia ser respondido adequadamente da forma como foi formulado. Ao comparar essas tarefas do mundo real com 58 testes de referência públicos, os pesquisadores descobriram que os testes cobriam apenas cerca de um terço do conjunto de tarefas e não incluíam o trabalho de documentação.

## Os fatos

- 127,833 consultas de 6,342 profissionais de saúde de 35 especialidades
- Os testes de referência correspondiam a apenas 31 % do conjunto de tarefas do mundo real

## Por que importa

Os hospitais talvez precisem reformular a avaliação de IA para refletir as tarefas cotidianas de documentação e busca de informações em que os profissionais de saúde realmente se apoiam.

## Fontes e referências

1. [Clinician use of language models diverges from how the models are evaluated](https://arxiv.org/abs/2610.11069) – arXiv, 2026-10-09

Última atualização: 2026-10-09
