# پیش‌انتشار llama.cpp v0.2.0 بهینه‌سازی Hexagon را اضافه کرد

> این اجراکننده متن‌باز مدل‌های زبانی بزرگ، بک‌اند Hexagon را برای اجرای سریع‌تر عملیات الحاق روی تراشه‌های Snapdragon به‌روزرسانی می‌کند.

Oossa · 2026-09-30 · https://oossa.com/fa/llama-cpp-v0-2-0-pre-release-adds-hexagon-cpu-optimizations

پروژه ggml‑org/llama.cpp در ۳۰ سپتامبر ۲۰۲۶ یک نسخه پیش‌انتشار با برچسب b11272 منتشر کرد. این نسخه بهینه‌سازی ویژه‌ای برای Hexagon به عملیات الحاق (concat) اضافه می‌کند؛ عملیاتی که در استنتاج مدل‌های زبانی رایج است. این تغییر با کاهش سربار بسته‌ها و استفاده از روال سریع‌تر تقسیم، حلقه داغِ جابه‌جایی داده‌ها را سرعت می‌بخشد. این به‌روزرسانی بخشی از مجموعه گسترده‌تری از نسخه‌ها برای پلتفرم‌های مختلف است که دستگاه‌های Android مجهز به Snapdragon و NPUهای Hexagon را هم دربرمی‌گیرد.

## حقایق

- برچسب نسخه: b11272 (کامیت 7fee178)، منتشرشده در ۳۰ سپتامبر ۲۰۲۶
- بهینه‌سازی عملیات الحاق در Hexagon تعداد بسته‌ها را کاهش می‌دهد و از دستور سریع div استفاده می‌کند

## چرا مهم است

این بهینه‌سازی اجرای مدل‌های زبانی بزرگ را روی گوشی‌های Snapdragon به‌طور محسوسی سریع‌تر می‌کند و تأخیر کارهای هوش مصنوعی روی دستگاه را کاهش می‌دهد.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11272](https://github.com/ggml-org/llama.cpp/releases/tag/b11272) – llama.cpp, 2026-09-30

آخرین به‌روزرسانی: 2026-09-30
