# پشتیبانی llama.cpp از عملیات DUP در WebGPU

> نسخه b11523 از llama.cpp عملیات DUP را در WebGPU اجرا می‌کند و مانع از کرش هنگام اجرای مدل‌ها با batchهای ترکیبی می‌شود.

Oossa · 2026-10-09 · https://oossa.com/fa/llama-cpp-adds-webgpu-support-for-duplicate-operation

کتابخانه متن‌باز llama.cpp در 9 اکتبر 2026 نسخه b11523 را منتشر کرد. این به‌روزرسانی کرشی را برطرف می‌کند که هنگام اجرای عملیات DUP در WebGPU رخ می‌داد. پیش‌تر، DUP روی CPU اجرا می‌شد و بقیه پردازش‌ها روی WebGPU؛ این تفاوت باعث ناسازگاری بافر و کرش می‌شد. حالا DUP هم مانند عملیات CPY (کپی) و CONT از همان مسیر کد استفاده می‌کند و روی WebGPU می‌ماند.

## حقایق

- نسخه b11523 در 2026-10-09 منتشر شد
- این اصلاح، پشتیبانی WebGPU از عملیات GGML_OP_DUP را اضافه می‌کند

## چرا مهم است

کاربران WebGPU می‌توانند مدل‌های llama.cpp را با batchهای ترکیبی اجرا کنند، بی‌آنکه برنامه کرش کند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

آخرین به‌روزرسانی: 2026-10-09
