# افزوده‌شدن کرنل‌های فلش‌اتنشن Metal به llama.cpp در macOS

> نسخه جدید محیط متن‌باز اجرای LLM در ۹ اکتبر ۲۰۲۶ منتشر شد و از فلش‌اتنشن ۱۲۸/۹۶ برای Apple Silicon پشتیبانی می‌کند.

Oossa · 2026-10-09 · https://oossa.com/fa/llama-cpp-adds-flash-attention-kernels-for-metal-on-macos

تیم ggml‑org در ۹ اکتبر ۲۰۲۶، llama.cpp (نسخه b11518) را به‌روزرسانی کرد. این تغییر کرنل‌های فلش‌اتنشن ۱۲۸‌بیتی و ۹۶‌بیتی را برای Metal اضافه می‌کند و اجرای مدل‌ها را روی مک‌های مجهز به Apple Silicon سریع‌تر می‌کند. فایل‌های اجرایی ازپیش‌ساخته برای macOS (arm64)، macOS اینتل، iOS و چند پیکربندی لینوکس برای دانلود ارائه شده‌اند.

## حقایق

- برچسب انتشار b11518 در جمعه ۹ اکتبر ۲۰۲۶ منتشر شد
- کرنل‌های فلش‌اتنشن Metal (۱۲۸/۹۶) برای Apple Silicon اضافه شده‌اند

## چرا مهم است

کاربران دستگاه‌های مجهز به Apple Silicon می‌توانند بدون خرید سخت‌افزار گرافیکی اضافه، LLMها را سریع‌تر اجرا کنند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11518](https://github.com/ggml-org/llama.cpp/releases/tag/b11518) – llama.cpp, 2026-10-09

آخرین به‌روزرسانی: 2026-10-09
