# llama.cpp incorpora selección codiciosa a temperatura cero

> La biblioteca de código abierto Llama.cpp ahora elige el token más probable cuando la temperatura se fija en cero, lo que simplifica la generación con poca variabilidad.

Oossa · 2026-10-07 · https://oossa.com/es/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

El proyecto ggml‑org/llama.cpp publicó una nueva versión el 7 de octubre de 2026. El cambio modifica el muestreador: cuando la temperatura es cero, el modelo siempre elige el token con mayor probabilidad (selección codiciosa). La actualización mantiene el muestreo aleatorio con temperaturas más altas y para las solicitudes de probabilidades personalizadas. El cambio se aplica a las ejecuciones en CPU y a las rutas que usan gramáticas o presupuestos de razonamiento.

## Los hechos

- Fecha de lanzamiento: 7 de octubre de 2026
- Nueva función: selección codiciosa con temperatura cero

## Por qué importa

Los desarrolladores pueden obtener resultados más predecibles cuando necesitan generar texto de forma determinista, sin configuración adicional.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Última actualización: 2026-10-07
