# llama.cpp setzt bei Temperatur 0 auf Greedy-Auswahl

> Die Open-Source-Bibliothek Llama.cpp wählt bei einer Temperatur von null jetzt immer das wahrscheinlichste Token aus und vereinfacht so die Generierung mit geringer Varianz.

Oossa · 2026-10-07 · https://oossa.com/de/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

Das Projekt ggml‑org/llama.cpp hat am 7. Okt. 2026 eine neue Version veröffentlicht. Sie ändert den Sampler: Bei einer Temperatur von null wählt das Modell nun immer das Token mit der höchsten Wahrscheinlichkeit aus (Greedy-Auswahl). Bei höheren Temperaturen und bei benutzerdefinierten Wahrscheinlichkeitsvorgaben bleibt die bisherige Zufallsauswahl bestehen. Die Änderung gilt für CPU-Läufe und für Abläufe mit Grammatikvorgaben oder Reasoning-Budgets.

## Die Fakten

- Veröffentlichungsdatum: 7. Okt. 2026
- Neue Funktion: Greedy-Auswahl bei Temperatur-0-Konfigurationen

## Warum es wichtig ist

Entwickler erhalten bei Bedarf besser vorhersehbare Ausgaben für die deterministische Textgenerierung – ohne zusätzliche Konfiguration.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Zuletzt aktualisiert: 2026-10-07
