# إطلاق OpenProblemBench لقياس أداء الذكاء الاصطناعي في مسائل رياضية وفيزيائية مفتوحة

> تضم مجموعة OpenProblemBench الجديدة 82 مسألة مفتوحة. وحلّ GPT-6-Astra نسبة 14% منها، متفوقًا بفارق كبير على النماذج الأخرى.

Oossa · 2026-10-09 · https://oossa.com/ar/openproblembench-benchmark-released-for-ai-on-unsolved-math-and-physics-question

أصدر باحثون OpenProblemBench، وهي مجموعة اختبارات تضم 82 مسألة لم تُحل بعد في الرياضيات والفيزياء النظرية. ويعرض المعيار السياق البحثي لكل مسألة، إلى جانب معايير واضحة للتحقق من الحل. وتتولى أربعة نماذج تقييم تصحيح الإجابات من حيث صحتها ومدى إحرازها تقدمًا، من دون الاستناد إلى إجابات مرجعية. وفي الاختبارات، حقق GPT-6-Astra متوسطًا بلغ 14.0% في حل المسائل، فيما تراوحت نتائج النماذج المفتوحة الأخرى كاملة الحجم بين 5.5% و6.7%، ونماذج Flash بين 2.4% و3.7%.

## الحقائق

- 82 مسألة مفتوحة في المعيار
- متوسط معدل الحل لدى GPT-6-Astra: 14.0%

## لماذا يهم

يُظهر المعيار أن أحدث نماذج اللغة الكبيرة يمكنه إحراز تقدم قابل للقياس في مسائل بحثية حقيقية، ما يلمّح إلى تنامي دور الذكاء الاصطناعي في العلوم النظرية.

## المصادر والمراجع

1. [OpenProblemBench: Benchmarking AI on Open Problems in the Foundational Theoretical Sciences](https://arxiv.org/abs/2610.11118) – arXiv, 2026-10-09

آخر تحديث: 2026-10-09
