# llama.cpp non sovrascrive più gli slot occupati

> La versione del 10 ottobre 2026 corregge un bug per cui una nuova richiesta poteva compromettere una generazione in corso sovrascrivendone la cache del prompt.

Oossa · 2026-10-10 · https://oossa.com/it/llama-cpp-update-stops-overwriting-busy-slots

Il progetto llama.cpp ha pubblicato la versione b11552 il 2026‑10‑10. La modifica impedisce a una richiesta di aggiornare la cache del prompt di uno slot già occupato. In precedenza, lo slot veniva sovrascritto e la generazione proseguiva con un contesto errato. Ora lo slot occupato resta invariato e la nuova richiesta attende che si liberi.

## I fatti

- La versione b11552 è stata pubblicata sabato 10 ottobre 2026
- La correzione impedisce di aggiornare la cache del prompt di uno slot occupato (id_slot)

## Perché conta

Gli sviluppatori che usano llama.cpp riscontreranno meno errori di generazione quando più richieste condividono la stessa memoria GPU.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11552](https://github.com/ggml-org/llama.cpp/releases/tag/b11552) – llama.cpp, 2026-10-10

Ultimo aggiornamento: 2026-10-10
