# Çözülememiş matematik ve fizik soruları için OpenProblemBench yayımlandı

> Yeni OpenProblemBench, 82 açık problem içeriyor. GPT-6-Astra bunların yüzde 14’ünü çözerken diğer modellerin gerisinde kaldı.

Oossa · 2026-10-09 · https://oossa.com/tr/openproblembench-benchmark-released-for-ai-on-unsolved-math-and-physics-question

Araştırmacılar, matematik ve teorik fizikten henüz çözülememiş 82 soruyu içeren OpenProblemBench adlı test paketini yayımladı. Her problemde araştırma bağlamı ve çözümün nasıl değerlendirileceğine ilişkin açık ölçütler yer alıyor. Dört değerlendirici model, referans yanıtlara başvurmadan gönderilen çözümleri doğruluk ve kaydedilen ilerleme açısından puanlıyor. Testlerde GPT-6-Astra’nın ortalama çözüm oranı yüzde 14,0 oldu. Diğer tam boyutlu açık modeller yüzde 5,5 ile yüzde 6,7 arasında, Flash modeller ise yüzde 2,4 ile yüzde 3,7 arasında sonuç aldı.

## Gerçekler

- Kıyaslama setinde 82 açık problem bulunuyor
- GPT-6-Astra’nın ortalama çözüm oranı: yüzde 14,0

## Neden önemli

Son büyük dil modelinin gerçek araştırma sorularında ölçülebilir ilerleme kaydedebildiğini gösteren bu sonuç, yapay zekânın teorik bilimde giderek daha fazla rol üstlenebileceğine işaret ediyor.

## Kaynaklar ve referanslar

1. [OpenProblemBench: Benchmarking AI on Open Problems in the Foundational Theoretical Sciences](https://arxiv.org/abs/2610.11118) – arXiv, 2026-10-09

Son güncelleme: 2026-10-09
