Il team ggml-org ha pubblicato llama.cpp versione b11486 l’8 ottobre 2026. L’aggiornamento migliora la precisione della funzione di attivazione GELU, un componente matematico usato in molti modelli linguistici. Include inoltre binari precompilati per Apple Silicon, macOS con processori Intel, iOS e diverse configurazioni Ubuntu (CPU, Vulkan, CUDA). I binari sono scaricabili direttamente dalla pagina della release.
Perché conta
Gli sviluppatori possono eseguire i modelli LLaMA sui propri computer con calcoli più precisi e più veloci.