# llama.cpp پشتیبانی از بافر Hexagon را افزود و اندازه پیش‌فرض را افزایش داد

> کتابخانه متن‌باز llama.cpp حالا به دستگاه‌های Hexagon امکان می‌دهد تنسورهای بزرگ را میان چند بافر تقسیم کنند و اندازه پیش‌فرض بافر پویا را به 512 MB افزایش می‌دهد.

Oossa · 2026-10-08 · https://oossa.com/fa/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

پروژه llama.cpp نسخه b11490 را در 2026‑10‑08 منتشر کرد. این نسخه از API «alloc_buffer_n» در Hexagon پشتیبانی می‌کند و به این ترتیب تنسورهای بزرگ را می‌توان میان چند بافر تقسیم کرد. اندازه پیش‌فرض بافر پویا از 128 MB به 512 MB افزایش یافته تا از افت عملکرد هنگام کار با مدل‌های بزرگ جلوگیری شود. پرچم جدید «--no-embd-offload» هم نوشتن خط فرمان را برای دستگاه‌هایی که نمی‌توانند تعبیه‌ها را برون‌سپاری کنند ساده‌تر می‌کند. Jhen‑Jie Hong نیز در نگارش این تغییرات همکاری داشته است.

## حقایق

- تاریخ انتشار: 2026‑10‑08 («Thu Oct 08 2026 06:58:59 GMT+0200»)
- اندازه پیش‌فرض بافر پویا به 512 MB افزایش یافته است

## چرا مهم است

توسعه‌دهندگانی که از سخت‌افزار مبتنی بر Hexagon استفاده می‌کنند، می‌توانند مدل‌های زبانی بزرگ‌تری را با بازده بیشتر و بدون نیاز به تنظیم دستی بافر اجرا کنند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

آخرین به‌روزرسانی: 2026-10-08
