Bir ekip, kodlama ajanlarının tek bir görüntüden Blender betikleri yazma becerisini ölçmek için simüle edilmiş 3D sahnelerden oluşturulan 208 fotoğraflık LEGO‑Bench test setini tanıttı. Altı GPT yapılandırması test edildi. En iyi model olan GPT‑6 Astra, iç mekân sahnelerini %53.4, dış mekân sahnelerini ise %39.6 oranında doğru biçimde yeniden oluşturdu. Ajanlar genellikle kullanılabilir bir sahne dosyası üretebildi, ancak geometrik doğruluğu değerlendirme becerileri rastgele tahmine yakın kaldı. Sahneyi referans görüntüye sabitleyen bir eklenti, daha zayıf modellerin performansını %62.7’ye kadar artırdı.
Neden önemli
3D araçları geliştirenler açısından sonuçlar, yapay zekânın sahne oluşturmanın ilk aşamasını otomatikleştirebildiğini, ancak geometriyi güvenilir biçimde denetlemek için hâlâ ek yöntemlere ihtiyaç olduğunu gösteriyor.