ggml‑org ha pubblicato la versione b11466 di llama.cpp il 7 ottobre 2026. L’aggiornamento corregge il controllo supports_op di flash_attn per le coppie chiave-valore sovrapposte. Include inoltre binari pronti all’uso per macOS con Apple Silicon, macOS Intel, iOS e diverse versioni di Ubuntu (CPU, Vulkan e CUDA 12.8). I file si possono scaricare dalla pagina della release su GitHub.
Perché conta
Gli sviluppatori possono usare la versione più recente di llama.cpp su più piattaforme senza doverla compilare dal codice sorgente.