Oossa

InternLM släpper AutoVerifier-modell för bedömning av matematiska bevis på Hugging Face

Den nya modellen granskar bevis skrivna på naturligt språk, pekar ut fel och markerar det första felaktiga steget – och hjälper därmed till att utvärdera bidrag till AdvancedMathBench.

NotisOossa1 min läsning

InternLM:s AutoVerifier-modell finns nu på Hugging Face och bygger på Qwen3_5Moe-arkitekturen. Den läser ett problem, en eventuell referenslösning och ett stegvis kandidatbevis. Därefter anger den om beviset är korrekt, vilka fel det innehåller och indexet för det första misstaget. Modellen är paketerad i 40 safetensor-filer på sammanlagt cirka 68 GiB och använder InternS1Tokenizer. Den är tänkt att fungera som en automatisk rättare för AdvancedMathBench-sviten ProverBench, men utvecklaren påpekar att modellen fortfarande kan göra misstag.

Modellen kan köras utan att vikterna läses in genom att man skapar en prompt med den medföljande mallen proof_verifier.md och sedan matar in den i tokeniserarens chattformat.

Varför det spelar roll

Det ger forskare ett snabbt, automatiserat sätt att utvärdera avancerade matematiska bevis utan manuell rättning.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1New model on Hugging Face: internlm/AdvancedMathBench-AutoVerifier (image-text-to-text) ↗InternLM29 sep. 2026Organisation internlm published internlm/AdvancedMathBench-AutoVerifier.

1 källor

Senast uppdaterad: ·Markdown·llms.txt