Oossa

وكلاء الذكاء الاصطناعي يحوّلون الصور إلى مشاهد Blender ثلاثية الأبعاد قابلة للتحرير

قيّم باحثون ستة نماذج GPT في معيار جديد؛ وحقق أفضلها دقة تقارب 53% في المشاهد الداخلية، لكن تقدير الأشكال الهندسية ظل قريبًا من التخمين.

خبر موجزOossaنشرته Oossa: 1 دقائق قراءة

قدّم فريق بحثي LEGO‑Bench، وهي مجموعة اختبار تضم 208 صور مولّدة من مشاهد ثلاثية الأبعاد محاكاة، لقياس مدى قدرة وكلاء البرمجة على كتابة نصوص Blender البرمجية انطلاقًا من صورة واحدة. واختُبرت ستة إعدادات من GPT؛ فأعاد النموذج الأفضل، GPT‑6 Astra، بناء المشاهد الداخلية بدقة في 53.4% من الحالات، والمشاهد الخارجية في 39.6%. وتمكنت الوكلاء عادةً من إنتاج ملف مشهد صالح للاستخدام، لكن قدرتها على تقدير دقة الأشكال الهندسية بقيت قريبة من التخمين. وأدت إضافة مكوّن إضافي يثبت المشهد بالاستناد إلى الصورة المرجعية إلى تحسين أداء النماذج الأضعف بما يصل إلى 62.7%.

لماذا يهم

تُظهر النتائج لمطوري أدوات التصميم ثلاثي الأبعاد أن الذكاء الاصطناعي قادر على أتمتة إنشاء المشهد الأولي، لكن التحقق الموثوق من الأشكال الهندسية لا يزال ضروريًا.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.