ggml-org-teamet har publicerat llama.cpp-versionen b11531. Chatt-API:t har omarbetats och paketet innehåller färdigbyggda binärer för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-varianter, med stöd för CPU, Vulkan och CUDA 12.8. Nedladdningslänkar finns på GitHub-sidan för versionen. Användare kan nu köra LLM:er lokalt på fler plattformar utan att själva behöva kompilera programmet.
Varför det spelar roll
Utvecklare kan i dag köra Llama-modeller lokalt på fler enheter utan att behöva bygga programmet själva, med stöd för GPU-acceleration i Ubuntu.