# llama.cpp b11391 : ajustement CUDA et nouveaux binaires

> Le moteur LLM open source passe à la version b11391, avec une petite modification du code CUDA et de nouveaux binaires pour macOS, iOS et plusieurs plateformes Ubuntu.

Oossa · 2026-10-04 · https://oossa.com/fr/llama-cpp-vb11391-adds-cuda-tweak-and-new-pre-built-binaries

L’équipe ggml-org a publié llama.cpp version b11391 le 4 octobre 2026. La mise à jour déplace une variable CUDA appelée blocks_per_col à l’endroit où elle est utilisée. Cette modification a été validée par Adrien Gallouët. La version inclut également de nouveaux binaires précompilés pour macOS sur Apple Silicon, macOS sur processeur Intel, iOS et plusieurs versions d’Ubuntu (CPU, Vulkan et CUDA 12). Tous les fichiers sont téléchargeables depuis la page de la version sur GitHub.

## Les faits

- La version b11391 est sortie le 2026-10-04
- Ajoute une modification du code CUDA et des binaires pour macOS, iOS et Ubuntu (CPU, Vulkan, CUDA 12)

## Pourquoi c'est important

Les développeurs peuvent désormais utiliser llama.cpp sur davantage de matériel sans configuration préalable, notamment ceux qui disposent de GPU compatibles CUDA.

## Sources et références

1. [ggml-org/llama.cpp b11391](https://github.com/ggml-org/llama.cpp/releases/tag/b11391) – llama.cpp, 2026-10-04

Dernière mise à jour: 2026-10-04
