# پشتیبانی llama.cpp از AVX512‑FP16 در نسخه b11262

> کتابخانه متن‌باز llama.cpp اکنون با استفاده از AVX512‑FP16، ضرب داخلی با دقت نیمه را با دقت کامل محاسبه می‌کند و عملکرد پردازنده را بهبود می‌دهد.

Oossa · 2026-09-29 · https://oossa.com/fa/llama-cpp-adds-avx512-fp16-dot-product-support-in-b11262-release

تیم ggml‑org در ۲۹ سپتامبر ۲۰۲۶ نسخه b11262 از llama.cpp را منتشر کرد. این به‌روزرسانی پشتیبانی از AVX512‑FP16 را اضافه می‌کند؛ مجموعه‌دستورالعملی که ضرب داخلی با دقت نیمه (f16) را انجام می‌دهد، اما حاصل‌ها را برای دقت بیشتر با دقت تک‌ (f32) انباشته می‌کند. این تغییر در سطح پایین، استنتاج را روی پردازنده‌هایی که از مجموعه‌دستورالعمل AVX512‑FP16 پشتیبانی می‌کنند، سریع‌تر می‌کند. این نسخه همچنین فایل‌های اجرایی تازه‌ای برای macOS، iOS و چندین نسخه لینوکس ارائه می‌دهد.

## حقایق

- نسخه b11262 در ۲۹ سپتامبر ۲۰۲۶ منتشر شد
- پشتیبانی از انباشت حاصل ضرب داخلی AVX512‑FP16 با دقت f32 اضافه شد

## چرا مهم است

این قابلیت به توسعه‌دهندگان امکان می‌دهد مدل‌های زبانی بزرگ را روی پردازنده‌های جدیدتر سریع‌تر اجرا کنند، بی‌آنکه از دقت محاسباتی کاسته شود.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11262](https://github.com/ggml-org/llama.cpp/releases/tag/b11262) – llama.cpp, 2026-09-29

آخرین به‌روزرسانی: 2026-09-29
