Notis · 1 min läsning
LLM-filter minskar felen i AI-transkribering av brusigt polisl ljud
Forskare har tagit fram ett LLM-baserat filter som förbättrar pseudomärkning för taligenkänning av brusig radiokommunikation från polis, vilket minskar transkriptionsfelen.
Oossa · Om Oossa
Forskargruppen under ledning av Kaavya Chaparala utvärderade två grundmodeller för taligenkänning – OpenAI:s Whisper och Qwen3-ASR – på brusig radiokommunikation från polis i Baltimore och Chicago. De fann att modellernas inbyggda konfidensvärden inte kunde skilja bra maskinskapade transkriptioner från dåliga. Genom att använda en stor språkmodell som extern bedömare för att sortera bort pseudomärkningar som inte var rimliga utifrån sammanhanget kunde de sänka ord-felfrekvensen i träningsdata. Artikeln, som har antagits till konferensen SLT 2026, föreslår också att modeller i framtiden skulle kunna byta pseudomärkningar med varandra.
Varför det spelar roll
Metoden gör det billigare och mer träffsäkert att omvandla brusiga polisupptagningar till läsbar text utan omfattande mänsklig märkning.
Källor och referenser
| # | Källa | Utgivare | Datum | Kärnpunkt |
|---|---|---|---|---|
| 1 | Pretrained ASR Pseudo-labeling for Noisy Police Audio ↗ | arXiv | 28 sep. 2026 | arXiv:2609.30469v1 Announce Type: new Abstract: Pretrained ASR systems perform poorly on noisy Broadcast Police Communication (BPC), hinderi |
1 källor
Senast uppdaterad:
Oossa · Nyhetsbrev
Veckans AI, förklarad
Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.