Uma equipe criou o LEGO‑Bench, um conjunto de teste com 208 fotos renderizadas a partir de cenas 3D simuladas, para medir a capacidade de agentes de programação de escrever scripts para o Blender com base em uma única imagem. Foram testadas seis configurações GPT. O melhor modelo, GPT‑6 Astra, reconstruiu corretamente cenas internas em 53,4% dos casos e cenas externas em 39,6%. Em geral, os agentes conseguiam gerar um arquivo de cena utilizável, mas sua capacidade de avaliar a precisão geométrica ficou perto do acaso. A inclusão de um plug-in que alinha a cena à imagem de referência aumentou o desempenho dos modelos mais fracos em até 62,7%.
Por que importa
Para quem desenvolve ferramentas 3D, os resultados mostram que a IA pode automatizar a criação inicial de cenas, mas ainda são necessárias verificações confiáveis da geometria.