ggml‑org/llama.cpp प्रोजेक्ट ने Oct 7, 2026 को नया संस्करण जारी किया। इसमें सैंपलर को बदलकर यह किया गया है कि तापमान शून्य होने पर मॉडल हमेशा सबसे अधिक संभावना वाले टोकन को चुनता है (ग्रीडी चयन)। अधिक तापमान और कस्टम प्रॉबेबिलिटी अनुरोधों के लिए पहले की तरह रैंडम सैंपलिंग जारी रहेगी। यह बदलाव CPU पर चलने वाले रन और ग्रामर या रीजनिंग बजट का इस्तेमाल करने वाले रास्तों पर भी लागू होता है।
यह क्यों मायने रखता है
जब डेवलपर को नियतात्मक टेक्स्ट जनरेशन चाहिए, तो वे बिना अतिरिक्त कॉन्फ़िगरेशन के अधिक अनुमानित आउटपुट पा सकते हैं।