llama.cpp प्रोजेक्ट ने 30 सितंबर, 2026 को नया संस्करण जारी किया। इसमें GLM‑5.3‑Flash (जिसे GLM5‑Next भी कहा जाता है) नाम के नए भाषा मॉडल आर्किटेक्चर का सपोर्ट जोड़ा गया है। अपडेट में कंप्यूट बफ़र का आकार घटाया गया है, लंबे कॉन्टेक्स्ट को डिकोड करने की गति बढ़ाई गई है और टोकन हैंडलिंग व GPU मेमोरी से जुड़ी कई गड़बड़ियां ठीक की गई हैं। ये बदलाव उन डेवलपरों के लिए हैं जो CPU या GPU पर स्थानीय रूप से LLM चलाते हैं।
यह क्यों मायने रखता है
नई सुविधाओं से उपयोगकर्ता अपने हार्डवेयर पर नवीनतम GLM मॉडल कम मेमोरी में और तेज़ी से चला सकेंगे।