# OpenProblemBench testar AI på olösta frågor i matematik och fysik

> Den nya testsviten OpenProblemBench innehåller 82 olösta problem. GPT-6-Astra löste 14 % av dem, långt fler än andra modeller.

Oossa · 2026-10-09 · https://oossa.com/sv/openproblembench-benchmark-released-for-ai-on-unsolved-math-and-physics-question

Forskare har lanserat OpenProblemBench, en testsvit med 82 olösta problem inom matematik och teoretisk fysik. För varje problem ger testsviten forskningsbakgrund och tydliga kriterier för att bedöma en lösning. Fyra utvärderingsmodeller bedömer inlämnade lösningar utifrån korrekthet och framsteg, utan att jämföra med facit. I testerna hade GPT-6-Astra en genomsnittlig lösningsgrad på 14.0 %, medan andra fullstora öppna modeller fick mellan 5.5 % och 6.7 %, och Flash-modeller 2.4 % till 3.7 %.

## Fakta

- 82 olösta problem i testsviten
- Genomsnittlig lösningsgrad för GPT-6-Astra: 14.0 %

## Varför det spelar roll

Det visar att den senaste stora språkmodellen kan göra mätbara framsteg med verkliga forskningsfrågor och antyder att AI får en allt större roll inom teoretisk vetenskap.

## Källor och referenser

1. [OpenProblemBench: Benchmarking AI on Open Problems in the Foundational Theoretical Sciences](https://arxiv.org/abs/2610.11118) – arXiv, 2026-10-09

Senast uppdaterad: 2026-10-09
