La libreria open source llama.cpp ha rilasciato la versione b11511 l’8 ottobre 2026. La release corregge un bug di lettura fuori dai limiti nella memoria CUDA nell’implementazione MMQ. Aggiunge inoltre binari pronti all’uso per macOS (Apple Silicon e Intel), iOS e Ubuntu su x64, arm64 e s390x, oltre a build Vulkan e CUDA 12.8.
Perché conta
Gli sviluppatori possono eseguire llama.cpp su più dispositivi senza arresti anomali, soprattutto se usano GPU NVIDIA.