Oossa

llama.cpp ondersteunt Hexagon-buffers en verhoogt standaardgrootte

Met de opensourcelibrary llama.cpp kunnen Hexagon-apparaten grote tensors nu over meerdere buffers verdelen. De standaardgrootte van de dynamische buffer stijgt naar 512 MB.

Kort berichtDoor Gepubliceerd door Oossa: 1 min lezen

Het llama.cpp-project bracht op 2026‑10‑08 versie b11490 uit. Deze versie ondersteunt de Hexagon-API "alloc_buffer_n", waarmee grote tensors over meerdere buffers kunnen worden verdeeld. De standaardgrootte van de dynamische buffer wordt verhoogd van 128 MB naar 512 MB om prestatieverlies bij grote modellen te voorkomen. De nieuwe vlag "--no-embd-offload" maakt opdrachtregels eenvoudiger voor apparaten die embeddings niet kunnen offloaden. Jhen‑Jie Hong was medeauteur van de wijzigingen.

Waarom het ertoe doet

Ontwikkelaars die hardware met Hexagon gebruiken, kunnen grotere taalmodellen efficiënter draaien zonder de buffergrootte handmatig af te stellen.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.