Hugging Face’te artık Qwen3_5Moe mimarisi üzerine kurulu InternLM AutoVerifier modeli yer alıyor. Model bir problemi, varsa referans çözümünü ve adım adım sunulan bir kanıtı okuyor; ardından kanıtın doğru olup olmadığını, varsa hataları ve ilk hatanın hangi adımda yapıldığını bildiriyor. Model, toplam boyutu yaklaşık 68 GiB olan 40 safetensors parçası hâlinde sunuluyor ve InternS1Tokenizer kullanıyor. AdvancedMathBench’in ProverBench paketinde otomatik değerlendirici olarak kullanılmak üzere tasarlanan model için geliştiricisi, yine de hata yapabileceği uyarısında bulunuyor.
Model, sağlanan proof_verifier.md şablonuyla bir istem oluşturup bunu tokenizer’ın sohbet biçimine vererek ağırlıkları yüklemeden çalıştırılabiliyor.
Neden önemli
Araştırmacılara, karmaşık matematiksel kanıtları elle değerlendirmeden hızlı ve otomatik biçimde inceleme olanağı sunuyor.