Teamet ggml-org publicerade llama.cpp-versionen b11277. Den åtgärdar ett problem med återställning av buffertar som orsakade minnesläckor. Uppdateringen innehåller också förbyggda binärer för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-varianter, inklusive alternativ med Vulkan och CUDA för GPU:er. Användare kan ladda ner filerna direkt från versionssidan.
Varför det spelar roll
Åtgärden av minnesläckan förbättrar stabiliteten för utvecklare som kör LLM:er lokalt, och de färdiga binärerna gör det enklare att prova llama.cpp på fler plattformar.