پروژه llama.cpp در 9 اکتبر 2026 پیشنسخهای تازه با نام b11517 منتشر کرد. این بهروزرسانی گزینهای برای CUDA اضافه میکند که به کاربران امکان میدهد دقت source-1 را به دستیارهای MMQ، بخشی سطحپایین از کد GPU، منتقل کنند. این تغییر با امضای یکی از مشارکتکنندگان NVIDIA منتشر شده و شامل نسخههای CUDA 12 و 13 برای Linux و Windows میشود. این انتشار همچنین اهداف ساخت را برای پلتفرمهای متعدد دیگری، از macOS با Apple Silicon تا Android با Snapdragon، در بر میگیرد.
این بهروزرسانی از صفحه GitHub پروژه و وبسایت llama.app در دسترس است.
چرا مهم است
توسعهدهندگان اکنون میتوانند دقت GPU را در llama.cpp کنترل کنند؛ قابلیتی که ممکن است کارایی یا میزان استفاده از حافظه را هنگام اجرای مدلهای LLaMA بهبود دهد.