O Hugging Face agora hospeda o modelo AutoVerifier da InternLM, baseado na arquitetura Qwen3_5Moe. Ele recebe um problema, uma solução de referência opcional e uma demonstração candidata passo a passo; em seguida, informa se ela está correta, aponta eventuais erros e indica o índice do primeiro erro. O modelo é distribuído em 40 partes no formato safetensors, que totalizam cerca de 68 GiB, e usa o InternS1Tokenizer. Ele foi projetado para corrigir automaticamente o conjunto ProverBench do AdvancedMathBench, embora o fornecedor ressalte que o modelo ainda pode cometer erros.
É possível usar o modelo sem carregar os pesos: basta montar um prompt com o modelo proof_verifier.md fornecido e, em seguida, passá-lo ao formato de chat do tokenizer.
Por que importa
A ferramenta oferece aos pesquisadores uma maneira rápida e automatizada de avaliar demonstrações matemáticas complexas sem correção manual.