# llama.cpp v0.1.15 corrige un dépassement mémoire CUDA et ajoute de nouveaux binaires

> La version de ggml-org du 8 octobre 2026 corrige un problème de mémoire CUDA et propose des binaires précompilés pour macOS, iOS et plusieurs plateformes Linux.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-v0-1-15-adds-cuda-out-of-bounds-fix-and-new-binaries

La bibliothèque open source llama.cpp est passée à la version b11511 le 8 octobre 2026. Cette mise à jour corrige un bug de lecture hors limites dans l’implémentation MMQ de CUDA. Elle ajoute aussi des binaires prêts à l’emploi pour macOS (Apple Silicon et Intel), iOS et Ubuntu sur x64, arm64 et s390x, ainsi que des versions pour Vulkan et CUDA 12.8.

## Les faits

- Tag de la version : b11511
- Correctif : lectures CUDA MMQ hors limites (#29953) – publié le 2026-10-08

## Pourquoi c'est important

Les développeurs peuvent désormais utiliser llama.cpp sur davantage de matériel sans plantage, en particulier avec des GPU NVIDIA.

## Sources et références

1. [ggml-org/llama.cpp b11511](https://github.com/ggml-org/llama.cpp/releases/tag/b11511) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
