# llama.cpp b11510 में बड़े टेंसरों के लिए CUDA सपोर्ट

> ओपन-सोर्स LLaMA इन्फ़रेंस लाइब्रेरी का संस्करण b11510 जारी हो गया है। इसमें 65,535 से अधिक पंक्तियों को संभालने वाला नया CUDA कर्नेल और macOS, iOS व Linux के लिए बाइनरी शामिल हैं।

Oossa · 2026-10-08 · https://oossa.com/hi/llama-cpp-b11510-adds-cuda-support-for-larger-tensors

ggml-org टीम ने 8 अक्टूबर 2026 को llama.cpp का संस्करण b11510 जारी किया। इसमें CUDA के लिए एक लूप वाला PAD कर्नेल जोड़ा गया है, जिससे लाइब्रेरी 65,000 से अधिक पंक्तियों या स्लाइस वाले टेंसर प्रोसेस कर सकती है। इस रिलीज़ में Apple Silicon, Intel macOS, iOS और Ubuntu के कई बिल्ड (CPU, Vulkan और CUDA 12.8) के लिए पहले से तैयार बाइनरी भी शामिल हैं। कोड और अटेस्टेशन GitHub पेज से उपलब्ध हैं।

## तथ्य

- संस्करण b11510 2026-10-08 को जारी हुआ
- नया CUDA PAD कर्नेल 65,535 से अधिक पंक्तियों को सपोर्ट करता है

## यह क्यों मायने रखता है

डेवलपर अब NVIDIA GPU पर पिछली पंक्ति-सीमा से टकराए बिना बड़े भाषा मॉडल चला सकते हैं।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11510](https://github.com/ggml-org/llama.cpp/releases/tag/b11510) – llama.cpp, 2026-10-08

अंतिम अपडेट: 2026-10-08
