Oossa

llama.cpp में GLM‑5.3‑Flash सपोर्ट और बेहतर परफ़ॉर्मेंस

ओपन-सोर्स LLM रनटाइम llama.cpp v0.1.0 में GLM‑5.3‑Flash मॉडल का सपोर्ट और गति व मेमोरी से जुड़े कई सुधार जोड़े गए हैं।

संक्षिप्तOossaOossa द्वारा प्रकाशित: 1 मिनट पढ़ना

llama.cpp प्रोजेक्ट ने 30 सितंबर, 2026 को नया संस्करण जारी किया। इसमें GLM‑5.3‑Flash (जिसे GLM5‑Next भी कहा जाता है) नाम के नए भाषा मॉडल आर्किटेक्चर का सपोर्ट जोड़ा गया है। अपडेट में कंप्यूट बफ़र का आकार घटाया गया है, लंबे कॉन्टेक्स्ट को डिकोड करने की गति बढ़ाई गई है और टोकन हैंडलिंग व GPU मेमोरी से जुड़ी कई गड़बड़ियां ठीक की गई हैं। ये बदलाव उन डेवलपरों के लिए हैं जो CPU या GPU पर स्थानीय रूप से LLM चलाते हैं।

यह क्यों मायने रखता है

नई सुविधाओं से उपयोगकर्ता अपने हार्डवेयर पर नवीनतम GLM मॉडल कम मेमोरी में और तेज़ी से चला सकेंगे।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।