La bibliothèque open source llama.cpp est passée à la version b11511 le 8 octobre 2026. Cette mise à jour corrige un bug de lecture hors limites dans l’implémentation MMQ de CUDA. Elle ajoute aussi des binaires prêts à l’emploi pour macOS (Apple Silicon et Intel), iOS et Ubuntu sur x64, arm64 et s390x, ainsi que des versions pour Vulkan et CUDA 12.8.
Pourquoi c'est important
Les développeurs peuvent désormais utiliser llama.cpp sur davantage de matériel sans plantage, en particulier avec des GPU NVIDIA.