Il team di ggml-org ha pubblicato la versione b11461 di llama.cpp il 2026-10-07. L’aggiornamento corregge la lettura lenta dei checkpoint quando si usa Vulkan sulle GPU AMD integrate. Include inoltre nuovi pacchetti binari per Apple Silicon, Mac Intel, iOS e diverse versioni di Linux (CPU, Vulkan, CUDA 12.8). Gli utenti possono scaricare l’archivio appropriato dalla pagina della release su GitHub.
Perché conta
Gli utenti con laptop AMD possono ora eseguire i modelli LLaMA più velocemente, senza il precedente rallentamento.