InternLM:s AutoVerifier-modell finns nu på Hugging Face och bygger på Qwen3_5Moe-arkitekturen. Den läser ett problem, en eventuell referenslösning och ett stegvis kandidatbevis. Därefter anger den om beviset är korrekt, vilka fel det innehåller och indexet för det första misstaget. Modellen är paketerad i 40 safetensor-filer på sammanlagt cirka 68 GiB och använder InternS1Tokenizer. Den är tänkt att fungera som en automatisk rättare för AdvancedMathBench-sviten ProverBench, men utvecklaren påpekar att modellen fortfarande kan göra misstag.
Modellen kan köras utan att vikterna läses in genom att man skapar en prompt med den medföljande mallen proof_verifier.md och sedan matar in den i tokeniserarens chattformat.
Varför det spelar roll
Det ger forskare ett snabbt, automatiserat sätt att utvärdera avancerade matematiska bevis utan manuell rättning.