تیم ggml‑org نسخه b11277 از llama.cpp را منتشر کرد. این نسخه مشکلی در بازنشانی بافر را برطرف میکند که باعث نشت حافظه میشد. همچنین باینریهای ازپیشساختهای برای macOS (Apple Silicon و Intel)، iOS و چندین نسخه Ubuntu، از جمله گزینههای پردازش گرافیکی Vulkan و CUDA، ارائه میدهد. کاربران میتوانند فایلها را مستقیماً از صفحه انتشار دانلود کنند.
چرا مهم است
رفع نشت حافظه پایداری را برای توسعهدهندگانی که مدلهای زبانی بزرگ را بهصورت محلی اجرا میکنند، افزایش میدهد و باینریهای آماده، آزمایش llama.cpp را روی پلتفرمهای بیشتری آسانتر میکنند.