# llama.cpp corregge l’instabilità del grafo di sampling

> La versione del 9 ottobre 2026 rende statico il grafo di sampling del backend tra un’ubatch e l’altra, migliorando l’affidabilità su tutte le piattaforme supportate.

Oossa · 2026-10-09 · https://oossa.com/it/llama-cpp-update-fixes-sampling-graph-instability

Il progetto ggml‑org/llama.cpp ha pubblicato la versione b11530 il 2026-10-09. La modifica mantiene statico il grafo di sampling del backend tra un’ubatch e l’altra, così la sua struttura non cambia più durante le fasi di reserve e decode. Questo risolve gli arresti anomali che si verificavano quando la topologia del grafo cambiava dopo una fase di reserve build. La correzione si applica a tutte le build indicate – macOS, Linux, Android, Windows e openEuler – e a tutti i backend hardware, come CUDA, Vulkan e OpenCL.

## I fatti

- Il tag della versione b11530 è stato pubblicato venerdì 9 ottobre 2026
- La correzione rende statico il grafo di sampling tra un’ubatch e l’altra, impedendo cambiamenti nella topologia del grafo

## Perché conta

Chi sviluppa con llama.cpp riscontrerà meno errori di esecuzione nelle generazioni con più output, su qualsiasi CPU o GPU supportata.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11530](https://github.com/ggml-org/llama.cpp/releases/tag/b11530) – llama.cpp, 2026-10-09

Ultimo aggiornamento: 2026-10-09
