OossaAI utvecklas fort. Vi förklarar det enkelt.
Nyhetsbrev

Notis · 1 min läsning

LLM-filter minskar felen i AI-transkribering av brusigt polisl ljud

Forskare har tagit fram ett LLM-baserat filter som förbättrar pseudomärkning för taligenkänning av brusig radiokommunikation från polis, vilket minskar transkriptionsfelen.

Oossa · Om Oossa

Forskargruppen under ledning av Kaavya Chaparala utvärderade två grundmodeller för taligenkänning – OpenAI:s Whisper och Qwen3-ASR – på brusig radiokommunikation från polis i Baltimore och Chicago. De fann att modellernas inbyggda konfidensvärden inte kunde skilja bra maskinskapade transkriptioner från dåliga. Genom att använda en stor språkmodell som extern bedömare för att sortera bort pseudomärkningar som inte var rimliga utifrån sammanhanget kunde de sänka ord-felfrekvensen i träningsdata. Artikeln, som har antagits till konferensen SLT 2026, föreslår också att modeller i framtiden skulle kunna byta pseudomärkningar med varandra.

Varför det spelar roll

Metoden gör det billigare och mer träffsäkert att omvandla brusiga polisupptagningar till läsbar text utan omfattande mänsklig märkning.

Var den här artikeln användbar?

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1Pretrained ASR Pseudo-labeling for Noisy Police Audio ↗arXiv28 sep. 2026arXiv:2609.30469v1 Announce Type: new Abstract: Pretrained ASR systems perform poorly on noisy Broadcast Police Communication (BPC), hinderi

1 källor

Senast uppdaterad:

Oossallms.txt.md

Dela

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

LLM-filter minskar felen i AI-transkribering av brusigt polisl ljud – Oossa