Oossa

InternLM مدل AutoVerifier را برای ارزیابی برهان‌های ریاضی در Hugging Face منتشر کرد

مدل جدید، برهان‌های نوشته‌شده به زبان طبیعی را بررسی می‌کند، خطاها را نشان می‌دهد و نخستین گام نادرست را مشخص می‌کند تا ارزیابی پاسخ‌های AdvancedMathBench آسان‌تر شود.

خبر کوتاهOossa1 دقیقه مطالعه

مدل AutoVerifier شرکت InternLM که بر پایهٔ معماری Qwen3_5Moe ساخته شده، اکنون در Hugging Face در دسترس است. این مدل مسئله، یک راه‌حل مرجع اختیاری و برهانی پیشنهادی را که گام‌به‌گام نوشته شده می‌خواند و سپس اعلام می‌کند برهان درست است یا نه، خطاهای آن را مشخص می‌کند و شمارهٔ نخستین گام اشتباه را برمی‌گرداند. مدل در قالب 40 بخش safetensor با حجمی در مجموع حدود 68 GiB عرضه شده و از InternS1Tokenizer استفاده می‌کند. این مدل برای ارزیابی خودکار مجموعهٔ ProverBench در AdvancedMathBench طراحی شده است؛ هرچند سازنده می‌گوید ممکن است همچنان خطا کند.

برای اجرای مدل بدون بارگذاری وزن‌ها، می‌توان با استفاده از الگوی proof_verifier.md ارائه‌شده یک پرامپت ساخت و سپس آن را با قالب گفت‌وگوی توکن‌ساز به مدل داد.

چرا مهم است

این مدل راهی سریع و خودکار در اختیار پژوهشگران می‌گذارد تا برهان‌های پیچیدهٔ ریاضی را بدون ارزیابی دستی بررسی کنند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1New model on Hugging Face: internlm/AdvancedMathBench-AutoVerifier (image-text-to-text) ↗InternLM۷ مهر ۱۴۰۵Organisation internlm published internlm/AdvancedMathBench-AutoVerifier.

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt