# В llama.cpp добавили режим mmap для экономии памяти

> Среда запуска LLM с открытым исходным кодом теперь позволяет напрямую отображать данные модели в память — это снижает расход ОЗУ в сборках для macOS, iOS и Linux.

Oossa · 2026-10-01 · https://oossa.com/ru/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

Команда ggml‑org выпустила llama.cpp версии b11324. В обновлении появился режим memory-map, который позволяет не создавать вторую полноразмерную копию каждого тензора при загрузке модели. Изменение доступно в новых бинарных пакетах для macOS (Apple Silicon и Intel), iOS и нескольких сборок Ubuntu. В релизе также отмечен вклад Claude и инженера NVIDIA Пранеша Гонегандлы.

## Факты

- Версия b11324 выпущена 2026-10-01
- Добавлена функция llama‑mmap для снижения расхода ОЗУ

## Почему это важно

Разработчики смогут запускать более крупные языковые модели на том же оборудовании. Это полезно энтузиастам и небольшим командам, которым не хватает памяти.

## Источники и ссылки

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

Обновлено: 2026-10-01
