# llama.cpp अपडेट में OpenVINO 2026.4.1 और MoE सुधार

> 3 अक्टूबर 2026 के अपडेट में OpenVINO बैकएंड अपग्रेड हुआ है, प्रदर्शन बेहतर हुआ है और llama.cpp में MoE मॉडल को सही ढंग से संभालने की समस्या ठीक की गई है।

Oossa · 2026-10-03 · https://oossa.com/hi/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

llama.cpp लाइब्रेरी का नया संस्करण (b11374) 3 अक्टूबर 2026 को जारी हुआ। इसमें OpenVINO बैकएंड को संस्करण 2026.4.1 पर अपग्रेड किया गया है, नया conv-fusion जोड़ा गया है, GPU बफ़र की गड़बड़ियां ठीक की गई हैं और mixture-of-experts (MoE) मॉडल के लिए axis हैंडलिंग सुधारी गई है। इन बदलावों से fused MoE मॉडल में टोकन जनरेट होने की रफ़्तार बढ़ती है और कुछ Intel GPU पर क्रैश होने से बचाव होता है।

## तथ्य

- जारी होने की तारीख: 3 अक्टूबर 2026 ("Sat Oct 03 2026 13:51:21 GMT+0200")
- OpenVINO को 2026.4.1 पर अपग्रेड किया गया; fused होने पर gemma-4-26B की टोकन जनरेशन रफ़्तार 66 t/s से बढ़कर 1 609 t/s हुई

## यह क्यों मायने रखता है

Intel GPU पर llama.cpp चलाने वाले डेवलपर अब OpenVINO का इस्तेमाल बेहतर रफ़्तार और कम क्रैश के साथ कर सकते हैं।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

अंतिम अपडेट: 2026-10-03
