Oossa

InternLM تطلق نموذج AutoVerifier لتقييم البراهين الرياضية على Hugging Face

يفحص النموذج الجديد البراهين المكتوبة باللغة الطبيعية، ويشير إلى الأخطاء ويحدد أول خطوة خاطئة، ما يساعد على تقييم المشاركات في AdvancedMathBench.

خبر موجزOossa1 دقائق قراءة

تستضيف منصة Hugging Face الآن نموذج AutoVerifier من InternLM، المبني على بنية Qwen3_5Moe. يقرأ النموذج المسألة، وحلًا مرجعيًا اختياريًا، وبرهانًا مقترحًا خطوة بخطوة، ثم يحدد ما إذا كان البرهان صحيحًا، ويبيّن أي أخطاء فيه، ويذكر رقم أول خطوة خاطئة. يأتي النموذج موزعًا على 40 ملف safetensor، بإجمالي نحو 68 GiB، ويستخدم InternS1Tokenizer. وهو مصمم ليكون أداة تقييم آلية لمجموعة ProverBench ضمن AdvancedMathBench، لكن الجهة المطوّرة تنبه إلى أنه قد يخطئ أحيانًا.

يمكن تشغيل النموذج من دون تحميل الأوزان، وذلك بإنشاء مطالبة باستخدام القالب المرفق proof_verifier.md، ثم تمريرها إلى صيغة المحادثة الخاصة بأداة الترميز.

لماذا يهم

يوفر للباحثين طريقة سريعة وآلية لتقييم البراهين الرياضية المعقدة من دون الحاجة إلى تصحيحها يدويًا.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.

المصادر والمراجع

#المصدرالجهة الناشرةالتاريخالخلاصة
1New model on Hugging Face: internlm/AdvancedMathBench-AutoVerifier (image-text-to-text) ↗InternLM29‏/09‏/2026Organisation internlm published internlm/AdvancedMathBench-AutoVerifier.

1 مصادر

آخر تحديث: ·Markdown·llms.txt