Un equipo presentó LEGO‑Bench, una prueba con 208 fotos generadas a partir de escenas 3D simuladas, para medir qué tan bien pueden los agentes de programación escribir scripts de Blender a partir de una sola imagen. Probaron seis configuraciones de GPT. El modelo con mejores resultados, GPT‑6 Astra, reconstruyó correctamente escenas de interiores el 53.4% de las veces y escenas exteriores el 39.6%. Por lo general, los agentes podían generar un archivo de escena utilizable, pero su capacidad para evaluar la precisión geométrica estuvo cerca del azar. Un complemento que ancla la escena a la imagen de referencia mejoró hasta un 62.7% a los modelos con peores resultados.
Por qué importa
Para quienes desarrollan herramientas 3D, los resultados muestran que la IA puede automatizar la creación inicial de escenas, pero aún hacen falta métodos fiables para comprobar la geometría.