ggml-org نسخهٔ b11539 از llama.cpp را منتشر کرده است؛ رانر سبک مدلهای زبانی بزرگ که روی دستگاههای متنوعی کار میکند. آرشیوهای باینری جدید برای macOS با Apple Silicon، مکهای اینتل، iOS XCFramework و چند نسخهٔ Ubuntu با پشتیبانی از CPU، Vulkan و CUDA 12.8 در دسترساند. پیوندهای دانلود در صفحهٔ انتشار GitHub قرار گرفتهاند.
چرا مهم است
توسعهدهندگان حالا میتوانند llama.cpp را بدون نیاز به ساختن آن، روی سختافزارهای بیشتری بهصورت محلی اجرا کنند.