Oossa

InternLM, Hugging Face’te matematiksel kanıtları değerlendiren AutoVerifier modelini yayımladı

Yeni model, doğal dilde yazılmış kanıtları kontrol ediyor, hataları belirtiyor ve yanlış yapılan ilk adımı işaretliyor. Böylece AdvancedMathBench başvurularının değerlendirilmesine yardımcı oluyor.

Kısa haberOossa1 dk okuma

Hugging Face’te artık Qwen3_5Moe mimarisi üzerine kurulu InternLM AutoVerifier modeli yer alıyor. Model bir problemi, varsa referans çözümünü ve adım adım sunulan bir kanıtı okuyor; ardından kanıtın doğru olup olmadığını, varsa hataları ve ilk hatanın hangi adımda yapıldığını bildiriyor. Model, toplam boyutu yaklaşık 68 GiB olan 40 safetensors parçası hâlinde sunuluyor ve InternS1Tokenizer kullanıyor. AdvancedMathBench’in ProverBench paketinde otomatik değerlendirici olarak kullanılmak üzere tasarlanan model için geliştiricisi, yine de hata yapabileceği uyarısında bulunuyor.

Model, sağlanan proof_verifier.md şablonuyla bir istem oluşturup bunu tokenizer’ın sohbet biçimine vererek ağırlıkları yüklemeden çalıştırılabiliyor.

Neden önemli

Araştırmacılara, karmaşık matematiksel kanıtları elle değerlendirmeden hızlı ve otomatik biçimde inceleme olanağı sunuyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1New model on Hugging Face: internlm/AdvancedMathBench-AutoVerifier (image-text-to-text) ↗InternLM29 Eyl 2026Organisation internlm published internlm/AdvancedMathBench-AutoVerifier.

1 kaynak

Son güncelleme: ·Markdown·llms.txt