تیم ggml‑org نسخه جدید llama.cpp را در ۳۰ سپتامبر ۲۰۲۶ منتشر کرد. این نسخه مشکلی را برطرف میکند که در آن درایور پردازنده گرافیکی MUSA، CUDA_ARCH را تعریف نمیکرد و در نتیجه بعضی از کرنلها خالی کامپایل میشدند. این وصله تشخیص معماری را بهدرستی اضافه میکند و بررسیهای تکراری را حذف میکند. در این انتشار همچنین فهرست بلندی از فایلهای اجرایی ازپیشساختهشده ارائه شده که حالا نسخههای CUDA 12.8 و 13.4 برای لینوکس و ویندوز و نیز پشتیبانی از هدفهای گوناگون ARM و Apple Silicon را دربر میگیرد.
چرا مهم است
توسعهدهندگان اکنون میتوانند بدون نیاز به وصلههای دستی، Llama.cpp را روی پردازندههای گرافیکی MUSA و نسخههای جدیدتر CUDA اجرا کنند.