Oossa

llama.cpp-update verhelpt instabiliteit in samplinggraph

De release van 9 okt 2026 houdt de samplinggraph van de backend statisch over ubatches heen en verhoogt zo de betrouwbaarheid op alle ondersteunde platforms.

Kort berichtDoor Gepubliceerd door Oossa: 1 min lezen

Het project ggml‑org/llama.cpp heeft op 2026‑10‑09 versie b11530 uitgebracht. De wijziging houdt de samplinggraph van de backend statisch over ubatches heen, zodat de vorm van de graph niet langer verandert tijdens reserve- en decodeerstappen. Hiermee worden crashes verholpen die ontstonden wanneer de topologie van de graph na een reserve-build verschoof. De oplossing geldt voor alle vermelde builds – macOS, Linux, Android, Windows en openEuler – en voor alle hardwarebackends, zoals CUDA, Vulkan en OpenCL.

Waarom het ertoe doet

Ontwikkelaars die llama.cpp gebruiken, krijgen minder runtimefouten bij het uitvoeren van generaties met meerdere outputs op elke ondersteunde CPU of GPU.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.