# llama.cpp aggiunge la mappatura in memoria per ridurre le copie dei tensori

> Il runtime open source per LLM consente ora di mappare direttamente i dati dei modelli, risparmiando RAM nelle build per macOS, iOS e Linux.

Oossa · 2026-10-01 · https://oossa.com/it/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

Il team ggml-org ha pubblicato la versione b11324 di llama.cpp. L’aggiornamento aggiunge una modalità di mappatura in memoria che evita di creare una seconda copia completa di ogni tensore durante il caricamento dei modelli. La novità è disponibile nei nuovi pacchetti binari per macOS (Apple Silicon e Intel), iOS e diverse build di Ubuntu. La versione segnala inoltre i contributi di Claude e dell’ingegnere di NVIDIA Pranesh Gonegandla.

## I fatti

- La versione b11324 è stata pubblicata il 2026-10-01
- Aggiunge la funzione llama-mmap per ridurre l’uso della RAM

## Perché conta

Gli sviluppatori possono eseguire modelli linguistici più grandi sullo stesso hardware, un vantaggio per gli appassionati e i piccoli team con memoria limitata.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

Ultimo aggiornamento: 2026-10-01
