# llama.cpp añade una opción de mapeo de memoria para reducir copias de tensores

> El entorno de ejecución de LLM de código abierto permite ahora mapear directamente los datos del modelo y ahorrar RAM en las versiones para macOS, iOS y Linux.

Oossa · 2026-10-01 · https://oossa.com/es/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

El equipo de ggml-org publicó la versión b11324 de llama.cpp. La actualización incorpora un modo de mapeo de memoria que evita crear una segunda copia completa de cada tensor al cargar modelos. La función está disponible en los nuevos paquetes binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu. En las notas de la versión también se reconocen las contribuciones de Claude y de Pranesh Gonegandla, ingeniero de NVIDIA.

## Los hechos

- La versión b11324 se publicó el 2026-10-01
- Añade la función llama-mmap para reducir el uso de RAM

## Por qué importa

Los desarrolladores pueden ejecutar modelos de lenguaje más grandes con el mismo hardware, algo útil para aficionados y equipos pequeños con memoria limitada.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

Última actualización: 2026-10-01
