Il progetto llama.cpp ha rilasciato la versione b11294 il 30 settembre 2026. L’aggiornamento introduce il prefetch delle righe su Windows: la libreria può così caricare in anticipo i dati del modello per accelerare la generazione. La modifica, proposta da Pranesh Gonegandla, è stata integrata senza ulteriori cambiamenti. L’aggiornamento comprende anche piccole operazioni di pulizia e correzioni alla compilazione.
Perché conta
Gli utenti Windows di llama.cpp potranno ottenere un’inferenza più rapida grazie alla nuova logica di prefetch.