# llama.cpp के प्री-रिलीज़ b11517 में CUDA प्रिसिजन विकल्प

> ओपन-सोर्स LLaMA इन्फ़रेंस लाइब्रेरी ने Oct 9, 2026 को संस्करण b11517 जारी किया। इसमें source‑1 प्रिसिजन सेट करने के लिए CUDA फ़्लैग जोड़ा गया है।

Oossa · 2026-10-09 · https://oossa.com/hi/llama-cpp-pre-release-b11517-adds-cuda-precision-option

llama.cpp प्रोजेक्ट ने 9 Oct 2026 को b11517 नाम से एक नया प्री-रिलीज़ प्रकाशित किया। इस अपडेट में CUDA का एक विकल्प जोड़ा गया है, जिसकी मदद से उपयोगकर्ता GPU कोड के निचले स्तर के हिस्से MMQ हेल्पर्स को source‑1 प्रिसिजन दे सकते हैं। इस बदलाव पर NVIDIA के एक योगदानकर्ता के हस्ताक्षर हैं और यह Linux तथा Windows के लिए सूचीबद्ध CUDA 12 और 13 बिल्ड पर लागू होता है। इस रिलीज़ में macOS Apple Silicon से लेकर Android Snapdragon तक कई अन्य प्लेटफ़ॉर्म के लिए बिल्ड टारगेट भी शामिल हैं।

यह अपडेट प्रोजेक्ट के GitHub पेज और llama.app वेबसाइट पर उपलब्ध है।

## तथ्य

- रिलीज़ टैग b11517, 09 Oct 2026 को प्रकाशित हुआ
- source‑1 प्रिसिजन के लिए CUDA फ़्लैग जोड़ा गया (CUDA 12 और 13 बिल्ड पर लागू)

## यह क्यों मायने रखता है

डेवलपर अब llama.cpp में GPU प्रिसिजन नियंत्रित कर सकते हैं, जिससे LLaMA मॉडल चलाने में प्रदर्शन बेहतर हो सकता है या मेमोरी का इस्तेमाल कम हो सकता है।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

अंतिम अपडेट: 2026-10-09
