# llama.cpp verbessert CPU-Unterstützung für BF16-Matrixeingaben

> Release b11292 ergänzt CPU-Unterstützung für eine BF16-Matrixeingabe bei der Depthwise-Convolution und verschärft die Vulkan-Kompatibilitätsprüfungen.

Oossa · 2026-09-30 · https://oossa.com/de/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

Mit KI-Unterstützung erstellt und übersetzt. Prüfen Sie die Originalquellen unten.

Das Release llama.cpp b11292 behebt eine Einschränkung des CPU-Backends bei der eindimensionalen Depthwise-Convolution, wenn deren Kernel BF16 verwendet, ein 16-Bit-Zahlenformat. Das CPU-Backend erweitert diese Eingabe für die Berechnung nun auf 32-Bit-Gleitkommazahlen. Damit entspricht die Arithmetik derjenigen des Metal-Matrix-Vektor-Kernels.

Außerdem ändert das Release die Vulkan-Prüfungen: BF16 wird als zweite Matrixeingabe nur akzeptiert, wenn auch die erste Eingabe BF16 ist. Andere Kombinationen werden als nicht unterstützt eingestuft, sodass der Scheduler sie auf der CPU ausführt. Die Versionshinweise erwähnen neue Tests, sagen aber nicht, wann die Änderungen in einer gebündelten App verfügbar sein werden oder welche Nutzer sie erhalten.

## Die Fakten

- Das Release llama.cpp b11292 wurde am 30. September 2026 veröffentlicht.
- Die Versionshinweise behandeln einen Test der Depthwise-Convolution mit F32-, F16- und BF16-Kernels sowie drei Matrixmultiplikationsfälle, bei denen die zweite Eingabe BF16 ist.

## Warum es wichtig ist

Für Entwickler, die BF16-Depthwise-Convolution ausführen, kann das CPU-Backend nun eine Kombination verarbeiten, die es zuvor abgelehnt hat. Die Versionshinweise nennen nicht, wann nachgelagerte Apps den Fix enthalten werden.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

Zuletzt aktualisiert: 2026-09-30
