Oossa

رفع ایراد بررسی نسخه CUDA در به‌روزرسانی llama.cpp

نسخه 8 اکتبر 2026 باگ تشخیص نسخه را برطرف می‌کند؛ باگی که مرتب‌سازی آرایه‌ها با CUDA را در نسخه‌های جدیدتر CCCL کند کرده بود.

خبر کوتاهنویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

پروژه llama.cpp نسخه b11509 را در 8 اکتبر 2026 منتشر کرد. این نسخه ایرادی در شرط بررسی CUDA را برطرف می‌کند که نسخه 4.x از CCCL را به‌اشتباه قدیمی‌تر تشخیص می‌داد و باعث افت بی‌سروصدای عملکرد در عملیات مرتب‌سازی آرایه‌ها می‌شد. در این اصلاح، بررسی جداگانهٔ مؤلفه‌های نسخه با مقایسهٔ یک عدد صحیحِ واحد و فشرده جایگزین شده و مسیر سریعِ تکرارگرِ گام‌دار دوباره فعال شده است. این تغییر روی RTX 4070 با CUDA 13.4 آزمایش شد و همهٔ آزمون‌های بک‌اند را با موفقیت پشت سر گذاشت.

چرا مهم است

توسعه‌دهندگانی که از llama.cpp در محیط‌های جدید CUDA استفاده می‌کنند، بدون نیاز به تغییر کدشان از مرتب‌سازی سریع‌تر بهره‌مند می‌شوند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.