# llama.cpp добавила жадный выбор при нулевой температуре

> В библиотеке Llama.cpp с открытым исходным кодом при нулевой температуре теперь выбирается наиболее вероятный токен — это упрощает генерацию с низкой вариативностью.

Oossa · 2026-10-07 · https://oossa.com/ru/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

Проект ggml‑org/llama.cpp выпустил новую версию 7 октября 2026 года. В ней изменён механизм выбора токенов: при нулевой температуре модель всегда выбирает токен с наибольшей вероятностью. При более высоких значениях температуры и запросах с пользовательским распределением вероятностей сохраняется случайный выбор. Изменение распространяется на запуски на CPU, а также на режимы с грамматикой или бюджетом рассуждений.

## Факты

- Дата выпуска: 7 октября 2026 года
- Новая функция: жадный выбор токенов при нулевой температуре

## Почему это важно

Разработчики могут получать более предсказуемые результаты при детерминированной генерации текста — без дополнительной настройки.

## Источники и ссылки

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Обновлено: 2026-10-07
