# llama.cpp b11499 améliore l’opération roll sur CUDA

> La version b11499 de l’environnement d’exécution LLM open source llama.cpp, publiée le 8 octobre 2026, corrige la prise en charge des opérations roll sur des données non contiguës avec CUDA et propose de nouveaux binaires précompilés pour macOS, iOS et Linux.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

L’équipe ggml-org a publié llama.cpp b11499 le 8 octobre 2026. Cette mise à jour modifie le backend CUDA pour utiliser des pas en octets lors de l’opération roll, ce qui permet au GPU de traiter correctement les données non contiguës. La version comprend également de nouveaux binaires pour Apple Silicon, les Mac Intel, iOS et plusieurs versions d’Ubuntu (CPU, Vulkan et CUDA 12). Tous les fichiers sont disponibles sur la page de la version sur GitHub.

## Les faits

- La version b11499 a été publiée le 2026-10-08
- Le backend CUDA prend désormais en charge les opérations roll avec des pas exprimés en octets

## Pourquoi c'est important

Les développeurs peuvent utiliser llama.cpp sur davantage de configurations GPU sans rencontrer d’erreurs, ce qui élargit les possibilités d’exécuter des LLM localement sur des ordinateurs de bureau et des serveurs.

## Sources et références

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
