# llama.cpp corrige l’instabilité du graphe d’échantillonnage

> La version du 9 oct. 2026 rend le graphe d’échantillonnage du backend statique entre les ubatches, pour améliorer la fiabilité sur toutes les plateformes prises en charge.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-update-fixes-sampling-graph-instability

Le projet ggml‑org/llama.cpp a publié la version b11530 le 2026‑10‑09. Cette modification maintient le graphe d’échantillonnage du backend statique entre les ubatches : sa structure ne change donc plus pendant les étapes de réservation et de décodage. Elle corrige les plantages qui survenaient lorsque la topologie du graphe changeait après une opération de réservation. Le correctif s’applique à toutes les versions répertoriées — macOS, Linux, Android, Windows et openEuler — ainsi qu’à tous les backends matériels, notamment CUDA, Vulkan et OpenCL.

## Les faits

- Version b11530 publiée le vendredi 9 octobre 2026
- Le correctif rend le graphe d’échantillonnage statique entre les ubatches et empêche les changements de topologie du graphe

## Pourquoi c'est important

Les développeurs qui utilisent llama.cpp rencontreront moins d’erreurs à l’exécution lors de générations à sorties multiples, sur tout processeur ou GPU pris en charge.

## Sources et références

1. [ggml-org/llama.cpp b11530](https://github.com/ggml-org/llama.cpp/releases/tag/b11530) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
