Oossa

llama.cpp v0.1.15 corrige un dépassement mémoire CUDA et ajoute de nouveaux binaires

La version de ggml-org du 8 octobre 2026 corrige un problème de mémoire CUDA et propose des binaires précompilés pour macOS, iOS et plusieurs plateformes Linux.

BrèvePar Publié par Oossa: 1 min de lecture

La bibliothèque open source llama.cpp est passée à la version b11511 le 8 octobre 2026. Cette mise à jour corrige un bug de lecture hors limites dans l’implémentation MMQ de CUDA. Elle ajoute aussi des binaires prêts à l’emploi pour macOS (Apple Silicon et Intel), iOS et Ubuntu sur x64, arm64 et s390x, ainsi que des versions pour Vulkan et CUDA 12.8.

Pourquoi c'est important

Les développeurs peuvent désormais utiliser llama.cpp sur davantage de matériel sans plantage, en particulier avec des GPU NVIDIA.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.