Oossa

پشتیبانی llama.cpp از عملیات DUP در WebGPU

نسخه b11523 از llama.cpp عملیات DUP را در WebGPU اجرا می‌کند و مانع از کرش هنگام اجرای مدل‌ها با batchهای ترکیبی می‌شود.

خبر کوتاهنویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

کتابخانه متن‌باز llama.cpp در 9 اکتبر 2026 نسخه b11523 را منتشر کرد. این به‌روزرسانی کرشی را برطرف می‌کند که هنگام اجرای عملیات DUP در WebGPU رخ می‌داد. پیش‌تر، DUP روی CPU اجرا می‌شد و بقیه پردازش‌ها روی WebGPU؛ این تفاوت باعث ناسازگاری بافر و کرش می‌شد. حالا DUP هم مانند عملیات CPY (کپی) و CONT از همان مسیر کد استفاده می‌کند و روی WebGPU می‌ماند.

چرا مهم است

کاربران WebGPU می‌توانند مدل‌های llama.cpp را با batchهای ترکیبی اجرا کنند، بی‌آنکه برنامه کرش کند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.