Ett forskarlag har tagit fram LEGO‑Bench, ett test med 208 foton som renderats från simulerade 3D-miljöer. Testet mäter hur bra kodningsagenter kan skriva Blender-skript utifrån en enda bild. Sex GPT-konfigurationer testades. Den bästa modellen, GPT‑6 Astra, återskapade inomhusmiljöer korrekt i 53,4 procent av fallen och utomhusmiljöer i 39,6 procent. Agenterna kunde oftast skapa en användbar scenfil, men deras förmåga att bedöma geometrisk korrekthet låg nära slumpnivå. Ett tillägg som förankrar scenen i referensbilden förbättrade resultaten för de svagare modellerna med upp till 62,7 procent.
Varför det spelar roll
För utvecklare av 3D-verktyg visar resultaten att AI kan automatisera det första steget i att skapa scener, men att det fortfarande behövs tillförlitliga kontroller av geometrin.