# llama.cpp में BF16 मैट्रिक्स इनपुट के लिए CPU सपोर्ट

> रिलीज़ b11292 डेप्थवाइज़ कन्वोल्यूशन में इस्तेमाल होने वाले BF16 मैट्रिक्स इनपुट के लिए CPU सपोर्ट जोड़ती है और Vulkan की सपोर्ट जाँच को सख्त करती है।

Oossa · 2026-09-30 · https://oossa.com/hi/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

AI की सहायता से तैयार और अनुवादित। नीचे मूल स्रोत देखें।

llama.cpp की b11292 रिलीज़ में CPU बैकएंड की उस सीमा को दूर किया गया है, जिससे BF16 यानी 16-बिट नंबर फ़ॉर्मेट वाले कर्नेल के साथ डेप्थवाइज़ 1D कन्वोल्यूशन प्रभावित होता था। अब CPU बैकएंड गणना के लिए उस इनपुट को 32-बिट फ़्लोट में बदल देता है, जिससे गणना Metal के मैट्रिक्स-वेक्टर कर्नेल जैसी हो जाती है।

रिलीज़ में Vulkan की जाँच भी बदली गई है: वह दूसरे मैट्रिक्स इनपुट के तौर पर BF16 को तभी स्वीकार करता है, जब पहला इनपुट भी BF16 हो। दूसरे संयोजनों को असमर्थित माना जाता है, ताकि शेड्यूलर उन्हें CPU पर चलाए। रिलीज़ नोट्स में जोड़े गए परीक्षणों का ज़िक्र है, लेकिन यह नहीं बताया गया कि ये बदलाव पैकेज्ड ऐप में कब आएँगे या किन उपयोगकर्ताओं को मिलेंगे।

## तथ्य

- llama.cpp b11292 रिलीज़ 30 सितंबर, 2026 को प्रकाशित हुई।
- नोट्स में F32, F16 और BF16 कर्नेल के साथ डेप्थवाइज़ कन्वोल्यूशन का एक परीक्षण और दूसरे इनपुट के तौर पर BF16 वाले मैट्रिक्स गुणा के तीन मामले शामिल हैं।

## यह क्यों मायने रखता है

BF16 डेप्थवाइज़ कन्वोल्यूशन चलाने वाले डेवलपर अब CPU बैकएंड पर वह संयोजन भी चला सकते हैं जिसे यह पहले स्वीकार नहीं करता था; नोट्स में यह नहीं बताया गया कि अन्य ऐप्स में यह सुधार कब शामिल होगा।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

अंतिम अपडेट: 2026-09-30
