Oossa

llama.cpp نسخه b11499 با بهبود CUDA و باینری‌های جدید منتشر شد

محیط اجرای متن‌باز مدل‌های زبانی بزرگ llama.cpp در 8 اکتبر 2026 با نسخه b11499 منتشر شد. این نسخه ایرادی را در عملیات roll روی داده‌های غیرپیوسته در CUDA برطرف می‌کند و باینری‌های ازپیش‌ساخته‌شدهٔ جدیدی برای macOS، iOS و Linux دارد.

خبر کوتاهنویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

تیم ggml‑org نسخه b11499 از llama.cpp را در 8 اکتبر 2026 منتشر کرد. در این به‌روزرسانی، backend مربوط به CUDA برای عملیات roll از فاصلهٔ بایتی استفاده می‌کند و به GPU امکان می‌دهد داده‌های غیرپیوسته را درست پردازش کند. این نسخه همچنین باینری‌های تازه‌ای برای Apple Silicon، مک‌های مجهز به پردازندهٔ Intel، iOS و چند نسخهٔ Ubuntu (برای CPU، Vulkan و CUDA 12) ارائه می‌کند. همهٔ فایل‌ها از صفحهٔ انتشار در GitHub قابل دانلود هستند.

چرا مهم است

توسعه‌دهندگان می‌توانند llama.cpp را بدون خطا روی مجموعهٔ گسترده‌تری از پیکربندی‌های GPU اجرا کنند و استفاده از مدل‌های زبانی بزرگ به‌صورت محلی را روی رایانه‌های رومیزی و سرورها گسترش دهند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.