پروژه llama.cpp نسخه b11509 را در 8 اکتبر 2026 منتشر کرد. این نسخه ایرادی در شرط بررسی CUDA را برطرف میکند که نسخه 4.x از CCCL را بهاشتباه قدیمیتر تشخیص میداد و باعث افت بیسروصدای عملکرد در عملیات مرتبسازی آرایهها میشد. در این اصلاح، بررسی جداگانهٔ مؤلفههای نسخه با مقایسهٔ یک عدد صحیحِ واحد و فشرده جایگزین شده و مسیر سریعِ تکرارگرِ گامدار دوباره فعال شده است. این تغییر روی RTX 4070 با CUDA 13.4 آزمایش شد و همهٔ آزمونهای بکاند را با موفقیت پشت سر گذاشت.
چرا مهم است
توسعهدهندگانی که از llama.cpp در محیطهای جدید CUDA استفاده میکنند، بدون نیاز به تغییر کدشان از مرتبسازی سریعتر بهرهمند میشوند.