# انتشار llama.cpp b11324 با گزینه نگاشت حافظه برای کاهش کپی تنسورها

> محیط اجرای متن‌باز LLM اکنون داده‌های مدل را مستقیماً نگاشت می‌کند و مصرف RAM را در نسخه‌های macOS، iOS و Linux کاهش می‌دهد.

Oossa · 2026-10-01 · https://oossa.com/fa/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

تیم ggml‑org نسخه b11324 از llama.cpp را منتشر کرد. این به‌روزرسانی حالت نگاشت حافظه را اضافه می‌کند تا هنگام بارگذاری مدل‌ها، از ساخت یک کپی کامل و دوم از هر تنسور جلوگیری شود. این قابلیت در بسته‌های باینری جدید برای macOS (Apple Silicon و Intel)، iOS و چند نسخه از Ubuntu در دسترس است. در یادداشت انتشار همچنین از مشارکت‌های Claude و مهندس NVIDIA، Pranesh Gonegandla، قدردانی شده است.

## حقایق

- نسخه b11324 در 2026-10-01 منتشر شد
- قابلیت llama‑mmap برای کاهش مصرف RAM اضافه شده است

## چرا مهم است

توسعه‌دهندگان می‌توانند با همان سخت‌افزار مدل‌های زبانی بزرگ‌تری اجرا کنند؛ قابلیتی که برای علاقه‌مندان و تیم‌های کوچکی با حافظه محدود مفید است.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

آخرین به‌روزرسانی: 2026-10-01
