# Un filtro con LLM reduce los errores en las transcripciones de audio policial ruidoso generadas por IA

> Un equipo de investigadores presentó un filtro basado en LLM para mejorar el etiquetado pseudoautomático del reconocimiento de voz en comunicaciones policiales de radio con mucho ruido y reducir los errores de transcripción.

Oossa · 2026-09-28 · https://oossa.com/es/llm-filter-trims-errors-in-ai-transcriptions-of-noisy-police-audio

El equipo, dirigido por Kaavya Chaparala, evaluó dos modelos fundacionales de reconocimiento de voz —Whisper, de OpenAI, y Qwen3‑ASR— con comunicaciones policiales de radio con mucho ruido de Baltimore y Chicago. Los investigadores descubrieron que las puntuaciones de confianza integradas en los modelos no permitían distinguir las transcripciones automáticas buenas de las malas. Al usar un modelo de lenguaje grande como evaluador externo para descartar las etiquetas pseudoautomáticas poco plausibles en su contexto, redujeron la tasa de error por palabra de los datos de entrenamiento. El artículo, aceptado para la conferencia SLT 2026, también plantea como posible línea futura intercambiar las etiquetas pseudoautomáticas entre modelos.

## Los hechos

- Artículo aceptado para la conferencia SLT 2026
- Se evaluaron Whisper y Qwen3‑ASR con audio policial de Baltimore y Chicago

## Por qué importa

Este método permite convertir grabaciones policiales ruidosas en texto legible de forma más económica y precisa, sin necesidad de un etiquetado humano exhaustivo.

## Fuentes y referencias

1. [Pretrained ASR Pseudo-labeling for Noisy Police Audio](https://arxiv.org/abs/2609.30469) – arXiv, 2026-09-28

Última actualización: 2026-09-28
