# پشتیبانی llama.cpp از OpenVINO 2026.4.1 و رفع ایرادهای MoE

> به‌روزرسانی 3 اکتبر 2026 بک‌اند OpenVINO را ارتقا می‌دهد، عملکرد را بهبود می‌بخشد و نحوهٔ پردازش مدل‌های MoE را اصلاح می‌کند.

Oossa · 2026-10-03 · https://oossa.com/fa/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

نسخهٔ جدید کتابخانهٔ llama.cpp (b11374) در 3 اکتبر 2026 منتشر شد. این نسخه بک‌اند OpenVINO را به 2026.4.1 ارتقا می‌دهد، قابلیت جدید ادغام کانولوشن را اضافه می‌کند، خطاهای بافر GPU را برطرف می‌کند و نحوهٔ پردازش محور‌ها در مدل‌های ترکیب خبره (MoE) را اصلاح می‌کند. این تغییرات سرعت تولید توکن را در مدل‌های MoE ادغام‌شده افزایش می‌دهند و از کرش‌کردن روی برخی GPUهای Intel جلوگیری می‌کنند.

## حقایق

- تاریخ انتشار: 3 اکتبر 2026 ("Sat Oct 03 2026 13:51:21 GMT+0200")
- OpenVINO به نسخهٔ 2026.4.1 ارتقا یافت؛ سرعت تولید توکن برای gemma-4-26B در حالت ادغام‌شده از 66 t/s به 1 609 t/s افزایش یافت

## چرا مهم است

توسعه‌دهندگانی که llama.cpp را روی GPUهای Intel اجرا می‌کنند، حالا می‌توانند از OpenVINO با سرعت بیشتر و کرش‌های کمتر استفاده کنند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

آخرین به‌روزرسانی: 2026-10-03
