# llama.cpp、テンソルの複製を抑えるメモリマップ機能を追加

> オープンソースのLLM実行環境でモデルデータを直接マッピングできるようになり、macOS、iOS、Linux版でRAM使用量を削減できる。

Oossa · 2026-10-01 · https://oossa.com/ja/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

ggml‑orgチームはllama.cppのバージョンb11324をリリースした。今回のアップデートではメモリマップモードが追加され、モデルの読み込み時に各テンソルの全サイズ分のコピーをもう1つ作らずに済む。この変更は、macOS（Apple SiliconおよびIntel）、iOS、複数のUbuntuビルド向けの新しいバイナリパッケージで利用できる。リリースでは、ClaudeとNVIDIAのエンジニア、Pranesh Gonegandlaによる貢献にも触れている。

## 事実

- バージョンb11324を2026-10-01に公開
- RAM使用量を削減するllama‑mmap機能を追加

## なぜ重要か

同じハードウェアでより大規模な言語モデルを実行できるため、メモリに限りのある個人開発者や小規模チームに役立つ。

## 出典と参考資料

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

最終更新: 2026-10-01
