# بهینه‌سازی پردازش ردیف‌های تکراری در Vulkan به llama.cpp آمد

> کتابخانه متن‌باز استنتاج LLaMA حالا هنگام تکرار ردیف‌های GPU از انجام محاسبات اضافی صرف‌نظر می‌کند و روی دستگاه‌های Vulkan سریع‌تر عمل می‌کند.

Oossa · 2026-10-11 · https://oossa.com/fa/llama-cpp-adds-vulkan-duplicate-row-optimizations

پروژه llama.cpp نسخه b11554 را در 2026‑10‑11 منتشر کرد. این به‌روزرسانی اصلاحاتی ویژه Vulkan دارد که شناسه‌های ردیف تکراری را در ضرب ماتریسی تشخیص می‌دهد و به‌جای پردازش در یک حلقه، آن‌ها را در مرحله‌ای مقدماتی مدیریت می‌کند. همچنین بهینه‌سازی «hoist row ids» را بهبود می‌دهد تا همیشه اجرا شود و بتواند چندین کاشی فشرده تولید کند. این تغییرات به GPU اجازه می‌دهند گروه‌های کاری کمتری اجرا کند و در صورت امکان زودتر کار را متوقف کند.

## حقایق

- نسخه b11554 در Sun Oct 11 2026 منتشر شد
- مدیریت ردیف‌های تکراری در Vulkan به llama.cpp اضافه شد

## چرا مهم است

کاربران GPU در llama.cpp می‌توانند از استنتاج سریع‌تری بهره ببرند، چون کتابخانه دیگر محاسبات یکسان را تکرار نمی‌کند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11554](https://github.com/ggml-org/llama.cpp/releases/tag/b11554) – llama.cpp, 2026-10-11

آخرین به‌روزرسانی: 2026-10-11
