# llama.cpp corrige un bug de fusion MUL_MAT+ADD sur Metal

> La version du 7 octobre 2026 corrige une erreur du backend Metal qui faussait les probabilités de certains modèles.

Oossa · 2026-10-07 · https://oossa.com/fr/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

La bibliothèque ggml‑org/llama.cpp a publié la version b11475 le 7 octobre 2026. Celle-ci corrige un bug du backend Metal (GPU Apple) : lors d’une opération fusionnée MUL_MAT+ADD, celui-ci sélectionnait la mauvaise matrice résiduelle, ce qui produisait des résultats erronés pour les modèles effectuant plusieurs multiplications matricielles en une étape. Le correctif permet à l’encodeur de choisir le bon opérande et rétablit la précision des résultats sur les GPU Metal.

## Les faits

- La version b11475 a été publiée le 7 octobre 2026
- Avant le correctif, 27 des 28 cas de test échouaient sur Metal

## Pourquoi c'est important

Les développeurs qui utilisent llama.cpp sur des GPU Apple obtiendront désormais des résultats fiables, au lieu des probabilités uniformes produites auparavant.

## Sources et références

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

Dernière mise à jour: 2026-10-07
