# Filtro com LLM reduz erros em transcrições de áudio policial ruidoso feitas por IA

> Pesquisadores criaram um filtro baseado em LLM para aprimorar a criação de pseudorrótulos em sistemas de reconhecimento de fala aplicados a comunicações policiais transmitidas com ruído, reduzindo os erros de transcrição.

Oossa · 2026-09-28 · https://oossa.com/pt/llm-filter-trims-errors-in-ai-transcriptions-of-noisy-police-audio

A equipe liderada por Kaavya Chaparala avaliou dois modelos de reconhecimento de fala de base — o Whisper, da OpenAI, e o Qwen3‑ASR — usando comunicações policiais transmitidas com ruído de Baltimore e Chicago. Os pesquisadores descobriram que as pontuações de confiança incorporadas aos modelos não conseguiam diferenciar transcrições geradas por máquina boas das ruins. Ao usar um modelo de linguagem grande como avaliador externo para descartar pseudorrótulos incompatíveis com o contexto, reduziram a taxa de erro por palavra dos dados de treinamento. O artigo, aceito para a conferência SLT 2026, também propõe como possível caminho futuro trocar pseudorrótulos entre modelos.

## Os fatos

- Artigo aceito para a conferência SLT 2026
- Whisper e Qwen3‑ASR foram avaliados com áudios policiais de Baltimore e Chicago

## Por que importa

O método torna mais barato e preciso transformar gravações policiais ruidosas em texto legível, sem depender de uma rotulagem humana extensa.

## Fontes e referências

1. [Pretrained ASR Pseudo-labeling for Noisy Police Audio](https://arxiv.org/abs/2609.30469) – arXiv, 2026-09-28

Última atualização: 2026-09-28
