# llama.cpp får stöd för Hexagon-buffertar och större standardstorlek

> Biblioteket llama.cpp med öppen källkod kan nu dela upp stora tensorer mellan Hexagon-enheter och höjer den dynamiska standardbufferten till 512 MB.

Oossa · 2026-10-08 · https://oossa.com/sv/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

Projektet llama.cpp släppte version b11490 den 2026‑10‑08. Den lägger till stöd för Hexagons API ”alloc_buffer_n”, vilket gör det möjligt att dela upp stora tensorer på flera buffertar. Den dynamiska standardbuffertens storlek höjs från 128 MB till 512 MB för att undvika prestandaförsämringar med stora modeller. En ny flagga, ”--no-embd-offload”, förenklar kommandorader för enheter som inte kan avlasta embeddingar. Ändringarna har tagits fram gemensamt med Jhen‑Jie Hong.

## Fakta

- Släppdatum: 2026‑10‑08 (”Thu Oct 08 2026 06:58:59 GMT+0200”)
- Den dynamiska standardbufferten höjs till 512 MB

## Varför det spelar roll

Utvecklare som använder Hexagon-baserad hårdvara kan köra större språkmodeller effektivare utan att behöva justera buffertar manuellt.

## Källor och referenser

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Senast uppdaterad: 2026-10-08
