Oossa

llama.cpp b11499 verbetert CUDA-roll en voegt nieuwe binaries toe

De opensource-LLM-runtime llama.cpp verscheen op 8 okt 2026 in versie b11499. De update bevat een CUDA-fix voor niet-aaneengesloten roll-bewerkingen en nieuwe vooraf gebouwde binaries voor macOS, iOS en Linux.

Kort berichtDoor Gepubliceerd door Oossa: 1 min lezen

Het ggml-org-team bracht llama.cpp-release b11499 uit op 8 okt 2026. De update past de CUDA-backend aan zodat die voor de roll-bewerking byte-strides gebruikt. Daardoor kan de GPU niet-aaneengesloten data correct verwerken. De release bevat ook nieuwe binaries voor Apple Silicon, Intel-Macs, iOS en verschillende Ubuntu-builds (CPU, Vulkan en CUDA 12). Alle bestanden zijn te downloaden via de GitHub-releasepagina.

Waarom het ertoe doet

Ontwikkelaars kunnen llama.cpp op meer GPU-configuraties gebruiken zonder fouten, waardoor lokale LLM's op desktops en servers breder inzetbaar worden.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.