# llama.cpp نسخه b11499 با بهبود CUDA و باینری‌های جدید منتشر شد

> محیط اجرای متن‌باز مدل‌های زبانی بزرگ llama.cpp در 8 اکتبر 2026 با نسخه b11499 منتشر شد. این نسخه ایرادی را در عملیات roll روی داده‌های غیرپیوسته در CUDA برطرف می‌کند و باینری‌های ازپیش‌ساخته‌شدهٔ جدیدی برای macOS، iOS و Linux دارد.

Oossa · 2026-10-08 · https://oossa.com/fa/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

تیم ggml‑org نسخه b11499 از llama.cpp را در 8 اکتبر 2026 منتشر کرد. در این به‌روزرسانی، backend مربوط به CUDA برای عملیات roll از فاصلهٔ بایتی استفاده می‌کند و به GPU امکان می‌دهد داده‌های غیرپیوسته را درست پردازش کند. این نسخه همچنین باینری‌های تازه‌ای برای Apple Silicon، مک‌های مجهز به پردازندهٔ Intel، iOS و چند نسخهٔ Ubuntu (برای CPU، Vulkan و CUDA 12) ارائه می‌کند. همهٔ فایل‌ها از صفحهٔ انتشار در GitHub قابل دانلود هستند.

## حقایق

- نسخهٔ b11499 در 2026‑10‑08 منتشر شد
- backend مربوط به CUDA اکنون از عملیات roll با فاصلهٔ بایتی پشتیبانی می‌کند

## چرا مهم است

توسعه‌دهندگان می‌توانند llama.cpp را بدون خطا روی مجموعهٔ گسترده‌تری از پیکربندی‌های GPU اجرا کنند و استفاده از مدل‌های زبانی بزرگ به‌صورت محلی را روی رایانه‌های رومیزی و سرورها گسترش دهند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

آخرین به‌روزرسانی: 2026-10-08
