پروژه ggml‑org/llama.cpp در 7 اکتبر 2026 نسخه جدیدی منتشر کرد. در این نسخه، نمونهگیر طوری تغییر کرده است که وقتی دما صفر باشد، مدل همیشه توکنی را انتخاب میکند که بالاترین احتمال را دارد (انتخاب حریصانه). این بهروزرسانی، نمونهگیری تصادفیِ موجود را برای دماهای بالاتر و درخواستهای سفارشیِ احتمال حفظ میکند. این تغییر در اجراهای CPU و مسیرهایی که از دستور زبان یا بودجه استدلال استفاده میکنند نیز اعمال میشود.
چرا مهم است
توسعهدهندگان برای تولید متن قطعی، بدون نیاز به پیکربندی اضافی، خروجیهایی پیشبینیپذیرتر دریافت میکنند.