# llama.cpp ondersteunt Hexagon-buffers en verhoogt standaardgrootte

> Met de opensourcelibrary llama.cpp kunnen Hexagon-apparaten grote tensors nu over meerdere buffers verdelen. De standaardgrootte van de dynamische buffer stijgt naar 512 MB.

Oossa · 2026-10-08 · https://oossa.com/nl/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

Het llama.cpp-project bracht op 2026‑10‑08 versie b11490 uit. Deze versie ondersteunt de Hexagon-API "alloc_buffer_n", waarmee grote tensors over meerdere buffers kunnen worden verdeeld. De standaardgrootte van de dynamische buffer wordt verhoogd van 128 MB naar 512 MB om prestatieverlies bij grote modellen te voorkomen. De nieuwe vlag "--no-embd-offload" maakt opdrachtregels eenvoudiger voor apparaten die embeddings niet kunnen offloaden. Jhen‑Jie Hong was medeauteur van de wijzigingen.

## De feiten

- Releasedatum: 2026‑10‑08 ("Thu Oct 08 2026 06:58:59 GMT+0200")
- De standaardgrootte van de dynamische buffer is verhoogd naar 512 MB

## Waarom het ertoe doet

Ontwikkelaars die hardware met Hexagon gebruiken, kunnen grotere taalmodellen efficiënter draaien zonder de buffergrootte handmatig af te stellen.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Laatst bijgewerkt: 2026-10-08
