# llama.cpp verbetert CPU-ondersteuning voor BF16-matrixinvoer

> Release b11292 voegt CPU-ondersteuning toe voor een BF16-matrixinvoer bij depthwise-convolutie en scherpt de ondersteuningcontroles van Vulkan aan.

Oossa · 2026-09-30 · https://oossa.com/nl/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

Gemaakt en vertaald met AI-ondersteuning. Bekijk de oorspronkelijke bronnen hieronder.

De release llama.cpp b11292 verhelpt een beperking van de CPU-backend bij depthwise 1D-convolutie met een BF16-kernel, een getalnotatie van 16 bits. De CPU-backend zet die invoer nu om naar 32-bit float voor de berekening, net als de matrix-vector-kernel van Metal.

De release past ook de controles van Vulkan aan: BF16 wordt alleen als tweede matrixinvoer geaccepteerd als de eerste invoer ook BF16 is. Andere combinaties worden als niet-ondersteund gemarkeerd, zodat de scheduler ze op de CPU uitvoert. In de release notes staan nieuwe tests vermeld, maar er staat niet wanneer de wijzigingen in een verpakte app terechtkomen of welke gebruikers ze zullen ontvangen.

## De feiten

- Release llama.cpp b11292 is gepubliceerd op September 30, 2026.
- De release notes beschrijven een test voor depthwise-convolutie met F32-, F16- en BF16-kernels, plus drie matrixvermenigvuldigingsgevallen met BF16 als tweede invoer.

## Waarom het ertoe doet

Ontwikkelaars die BF16-depthwise-convolutie uitvoeren, kunnen nu op de CPU-backend een combinatie verwerken die daar eerder werd geweigerd. De release notes vermelden niet wanneer apps van derden de oplossing zullen bevatten.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

Laatst bijgewerkt: 2026-09-30
