# llama.cpp får minnesmappning som minskar kopiering av tensorer

> Den öppna LLM-miljön kan nu mappa modelldata direkt, vilket sparar RAM i versioner för macOS, iOS och Linux.

Oossa · 2026-10-01 · https://oossa.com/sv/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

Teamet bakom ggml-org har släppt llama.cpp version b11324. Uppdateringen lägger till ett läge för minnesmappning som gör att programmet slipper skapa en extra kopia i full storlek av varje tensor när modeller läses in. Funktionen finns i nya binärpaket för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-versioner. I versionsinformationen nämns också bidrag från Claude och NVIDIA-ingenjören Pranesh Gonegandla.

## Fakta

- Version b11324 släpptes 2026-10-01
- Lägger till funktionen llama-mmap för att minska RAM-användningen

## Varför det spelar roll

Utvecklare kan köra större språkmodeller på samma hårdvara, vilket underlättar för entusiaster och små team med begränsat minne.

## Källor och referenser

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

Senast uppdaterad: 2026-10-01
