# llama.cpp behebt Fehler bei Metal-Matrixoperationen

> Das Release vom 7. Oktober 2026 korrigiert einen Fehler im Metal-Backend, der bei einigen Modellen zu falschen Wahrscheinlichkeiten führte.

Oossa · 2026-10-07 · https://oossa.com/de/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

Die Bibliothek ggml‑org/llama.cpp hat am 7. Oktober 2026 Version b11475 veröffentlicht. Sie behebt einen Fehler im Metal-Backend (Apple-GPU), bei dem eine zusammengefasste MUL_MAT+ADD-Operation die falsche Residualmatrix auswählte. Dadurch kam es bei Modellen, die in einem Schritt mehrere Matrixmultiplikationen ausführen, zu falschen Ergebnissen. Mit der Korrektur wählt der Encoder den richtigen Operanden aus, sodass Metal-GPUs wieder korrekte Ausgaben liefern.

## Die Fakten

- Version b11475 wurde am 7. Oktober 2026 veröffentlicht
- Vor der Korrektur schlugen auf Metal 27 von 28 Testfällen fehl

## Warum es wichtig ist

Entwickler, die llama.cpp auf Apple-GPUs einsetzen, erhalten nun zuverlässige Modellausgaben statt der zuvor einheitlichen Wahrscheinlichkeiten.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

Zuletzt aktualisiert: 2026-10-07
