Het team achter ggml-org heeft release b11277 van llama.cpp gepubliceerd. Deze patch verhelpt een probleem bij het resetten van buffers dat geheugenlekken veroorzaakte. De update bevat ook vooraf gebouwde binaries voor macOS (Apple Silicon en Intel), iOS en verschillende Ubuntu-versies, met opties voor Vulkan- en CUDA-GPU’s. Gebruikers kunnen de bestanden rechtstreeks downloaden vanaf de releasepagina.
Waarom het ertoe doet
Door het geheugenlek te verhelpen wordt de stabiliteit beter voor ontwikkelaars die lokaal LLM’s draaien. De kant-en-klare binaries maken het bovendien eenvoudiger om llama.cpp op meer platforms uit te proberen.