گروهی از پژوهشگران LEGO‑Bench را معرفی کردند؛ مجموعهآزمایشیای شامل ۲۰۸ عکس که از صحنههای سهبعدی شبیهسازیشده رندر شدهاند و برای سنجش توانایی عاملهای کدنویس در نوشتن اسکریپتهای Blender از روی یک تصویر طراحی شده است. شش پیکربندی GPT آزمایش شدند. مدل برتر، GPT‑6 Astra، صحنههای داخلی را با دقت ۵۳٫۴٪ و صحنههای بیرونی را با دقت ۳۹٫۶٪ بازسازی کرد. عاملها معمولاً میتوانستند فایل صحنهای قابلاستفاده بسازند، اما تواناییشان در ارزیابی دقت هندسی نزدیک به حد تصادفی بود. افزودن افزونهای که صحنه را با تصویر مرجع همتراز میکند، عملکرد مدلهای ضعیفتر را تا ۶۲٫۷٪ بهبود داد.
چرا مهم است
برای توسعهدهندگان ابزارهای سهبعدی، نتایج نشان میدهد هوش مصنوعی میتواند ساخت اولیهٔ صحنهها را خودکار کند، اما همچنان به روشهای قابلاعتماد برای بررسی هندسه نیاز است.