Il team ggml-org ha pubblicato la release b11277 di llama.cpp. L’aggiornamento corregge un problema nel ripristino dei buffer che causava perdite di memoria. Include inoltre binari precompilati per macOS (Apple Silicon e Intel), iOS e diverse versioni di Ubuntu, con opzioni GPU Vulkan e CUDA. Gli utenti possono scaricare i file direttamente dalla pagina della release.
Perché conta
La correzione della perdita di memoria migliora la stabilità per gli sviluppatori che eseguono LLM in locale, mentre i binari già pronti rendono più semplice provare llama.cpp su un numero maggiore di piattaforme.