# llama.cpp अपडेट ने CUDA वर्ज़न जाँच की गड़बड़ी सुधारी

> Oct 8, 2026 के रिलीज़ में वर्ज़न-गार्ड की उस गड़बड़ी को ठीक किया गया है, जिससे नए CCCL रिलीज़ पर CUDA argsort धीमा हो गया था।

Oossa · 2026-10-08 · https://oossa.com/hi/llama-cpp-update-fixes-cuda-version-check-regression

llama.cpp प्रोजेक्ट ने Oct 8, 2026 को b11509 वर्ज़न जारी किया। इसमें CUDA गार्ड की वह गड़बड़ी ठीक की गई है, जो CCCL वर्ज़न 4.x को गलती से पुराना मान रहा था और argsort ऑपरेशन की परफ़ॉर्मेंस चुपचाप घटा रहा था। इस सुधार में अलग-अलग घटकों की जाँच की जगह एक ही पैक्ड इंटीजर से तुलना की गई है, जिससे तेज़ strided-iterator पाथ फिर से काम करने लगा है। इस बदलाव का RTX 4070 और CUDA 13.4 पर परीक्षण किया गया और यह सभी बैकएंड टेस्ट में सफल रहा।

## तथ्य

- रिलीज़ टैग b11509, 2026-10-08 को प्रकाशित
- RTX 4070 (sm_89) और CUDA 13.4 पर परीक्षण किया गया

## यह क्यों मायने रखता है

आधुनिक CUDA सेटअप पर llama.cpp इस्तेमाल करने वाले डेवलपर बिना कोड बदले तेज़ sorting performance पा सकेंगे।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

अंतिम अपडेट: 2026-10-08
