# llama.cpp में GLM‑5.3‑Flash सपोर्ट और बेहतर परफ़ॉर्मेंस

> ओपन-सोर्स LLM रनटाइम llama.cpp v0.1.0 में GLM‑5.3‑Flash मॉडल का सपोर्ट और गति व मेमोरी से जुड़े कई सुधार जोड़े गए हैं।

Oossa · 2026-09-30 · https://oossa.com/hi/llama-cpp-updates-add-glm-5-3-flash-support-and-performance-tweaks

AI की सहायता से तैयार और अनुवादित। नीचे मूल स्रोत देखें।

llama.cpp प्रोजेक्ट ने 30 सितंबर, 2026 को नया संस्करण जारी किया। इसमें GLM‑5.3‑Flash (जिसे GLM5‑Next भी कहा जाता है) नाम के नए भाषा मॉडल आर्किटेक्चर का सपोर्ट जोड़ा गया है। अपडेट में कंप्यूट बफ़र का आकार घटाया गया है, लंबे कॉन्टेक्स्ट को डिकोड करने की गति बढ़ाई गई है और टोकन हैंडलिंग व GPU मेमोरी से जुड़ी कई गड़बड़ियां ठीक की गई हैं। ये बदलाव उन डेवलपरों के लिए हैं जो CPU या GPU पर स्थानीय रूप से LLM चलाते हैं।

## तथ्य

- रिलीज़ की तारीख: 2026‑09‑30 ("बुधवार, 30 सितंबर 2026")
- GLM‑5.3‑Flash (GLM5‑Next) मॉडल का सपोर्ट जोड़ा गया

## यह क्यों मायने रखता है

नई सुविधाओं से उपयोगकर्ता अपने हार्डवेयर पर नवीनतम GLM मॉडल कम मेमोरी में और तेज़ी से चला सकेंगे।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11279](https://github.com/ggml-org/llama.cpp/releases/tag/b11279) – llama.cpp, 2026-09-30
2. [add GLM-5.3-Flash (GLM5-Next) support by timkhronos · Pull Request #27773 · ggml-org/llama.cpp](https://www.reddit.com/r/LocalLLaMA/comments/1wu0bdf/add_glm53flash_glm5next_support_by_timkhronos/) – Reddit r/LocalLLaMA, 2026-09-30
3. [add GLM-5.3-Flash (GLM5-Next) support (#27773) · ggml-org/llama.cpp@649dcb1](https://www.reddit.com/r/LocalLLaMA/comments/1wu3wxu/add_glm53flash_glm5next_support_27773/) – Reddit r/LocalLLaMA, 2026-09-30

अंतिम अपडेट: 2026-09-30
