# نسخه b11494 از llama.cpp بهینه‌سازی CUDA را اضافه کرد

> کتابخانه متن‌باز Llama.cpp اکنون در هر وارپ CUDA از چهار ستون حالت GDN استفاده می‌کند تا عملکرد GPU بهتر شود.

Oossa · 2026-10-08 · https://oossa.com/fa/llama-cpp-release-b11494-adds-cuda-warp-optimizations

تیم ggml‑org نسخه b11494 از llama.cpp را منتشر کرد. در این به‌روزرسانی، بک‌اند CUDA به‌جای دو ستون، چهار ستون حالت GDN را به هر وارپ اختصاص می‌دهد. این تنظیم اکنون به‌صورت پیش‌فرض فعال است. فایل‌های اجرایی برای macOS (Apple Silicon و Intel)، iOS و چند نسخه از Ubuntu برای دانلود در دسترس‌اند.

## حقایق

- برچسب انتشار b11494 در 2026-10-08 منتشر شد
- مقدار پیش‌فرض cols_per_warp در CUDA روی 4 تنظیم شد

## چرا مهم است

توسعه‌دهندگانی که llama.cpp را روی GPUهای NVIDIA اجرا می‌کنند، می‌توانند بدون تغییر کد خود انتظار استنتاج سریع‌تری داشته باشند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11494](https://github.com/ggml-org/llama.cpp/releases/tag/b11494) – llama.cpp, 2026-10-08

آخرین به‌روزرسانی: 2026-10-08
