# llama.cpp b11494 में CUDA वॉर्प ऑप्टिमाइज़ेशन

> ओपन-सोर्स Llama.cpp लाइब्रेरी अब हर CUDA वॉर्प में GDN की चार स्टेट कॉलम इस्तेमाल करती है, जिससे GPU पर प्रदर्शन बेहतर होता है।

Oossa · 2026-10-08 · https://oossa.com/hi/llama-cpp-release-b11494-adds-cuda-warp-optimizations

ggml‑org टीम ने llama.cpp का संस्करण b11494 जारी किया है। इस अपडेट में CUDA बैकएंड को हर वॉर्प में दो के बजाय GDN की चार स्टेट कॉलम असाइन करने के लिए बदला गया है। अब यही डिफ़ॉल्ट सेटिंग है। macOS (Apple Silicon और Intel), iOS और Ubuntu के कई बिल्ड डाउनलोड के लिए उपलब्ध हैं।

## तथ्य

- रिलीज़ टैग b11494 2026-10-08 को प्रकाशित हुआ
- CUDA का डिफ़ॉल्ट cols_per_warp 4 पर सेट किया गया

## यह क्यों मायने रखता है

NVIDIA GPU पर llama.cpp इस्तेमाल करने वाले डेवलपर बिना कोड बदले तेज़ इन्फ़रेंस की उम्मीद कर सकते हैं।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11494](https://github.com/ggml-org/llama.cpp/releases/tag/b11494) – llama.cpp, 2026-10-08

अंतिम अपडेट: 2026-10-08
