# llama.cpp、Hexagonのバッファ分割に対応　既定容量を512 MBに拡大

> オープンソースライブラリのllama.cppで、Hexagonデバイスが大きなテンソルを複数のバッファに分割できるようになり、動的バッファの既定容量も512 MBに増えました。

Oossa · 2026-10-08 · https://oossa.com/ja/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

llama.cppプロジェクトは2026‑10‑08にバージョンb11490をリリースしました。Hexagonの「alloc_buffer_n」APIに対応し、大きなテンソルを複数のバッファに分割できるようになりました。大規模モデルで性能が低下するのを避けるため、動的バッファの既定サイズを128 MBから512 MBに拡大しました。また、埋め込みのオフロードに対応しないデバイスでコマンドラインを簡潔にできる、新しい「--no-embd-offload」フラグも追加されました。これらの変更はJhen‑Jie Hongとの共同開発です。

## 事実

- リリース日：2026‑10‑08（「Thu Oct 08 2026 06:58:59 GMT+0200」）
- 動的バッファの既定容量を512 MBに拡大

## なぜ重要か

Hexagonベースのハードウェアを使う開発者は、バッファを手動で調整しなくても、より大きな言語モデルを効率よく実行できます。

## 出典と参考資料

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

最終更新: 2026-10-08
