Het project ggml‑org/llama.cpp bracht op 7 oktober 2026 een nieuwe versie uit. De sampler is aangepast: bij een temperatuur van nul kiest het model voortaan altijd het token met de hoogste waarschijnlijkheid (greedy-selectie). Bij hogere temperaturen en bij aangepaste verzoeken om waarschijnlijkheden blijft de bestaande willekeurige sampling behouden. De wijziging geldt voor CPU-runs en voor paden met grammatica of redeneerbudgetten.
Waarom het ertoe doet
Ontwikkelaars kunnen voorspelbaardere resultaten krijgen wanneer ze deterministische tekstgeneratie nodig hebben, zonder extra configuratie.