# llama.cpp में DUP ऑपरेशन के लिए WebGPU सपोर्ट

> संस्करण b11523 का अपडेट DUP ऑपरेशन को WebGPU पर चलाता है, जिससे मिक्स्ड-बैच मॉडल चलाते समय क्रैश नहीं होता।

Oossa · 2026-10-09 · https://oossa.com/hi/llama-cpp-adds-webgpu-support-for-duplicate-operation

ओपन-सोर्स llama.cpp लाइब्रेरी का संस्करण b11523, Oct 9, 2026 को जारी हुआ। इस अपडेट में उस क्रैश को ठीक किया गया है, जो WebGPU पर DUP ऑपरेशन चलाने की कोशिश के दौरान होता था। पहले DUP, CPU पर चलता था, जबकि बाकी काम WebGPU पर होता था। इससे बफ़र में गड़बड़ी होती और प्रोग्राम क्रैश हो जाता। अब DUP भी CPY (कॉपी) और CONT ऑपरेशन की तरह उसी कोड पाथ पर चलता है, इसलिए वह WebGPU पर ही रहता है।

## तथ्य

- संस्करण b11523, 2026-10-09 को जारी हुआ
- इस सुधार से GGML_OP_DUP ऑपरेशन के लिए WebGPU सपोर्ट जुड़ता है

## यह क्यों मायने रखता है

WebGPU यूज़र अब llama.cpp मॉडल को मिक्स्ड बैच के साथ चला सकते हैं और प्रोग्राम क्रैश नहीं होगा।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

अंतिम अपडेट: 2026-10-09
