# llama.cpp支持Hexagon缓冲区，默认分配提升至512 MB

> 开源库 llama.cpp 现可让 Hexagon 设备将大型张量拆分到多个缓冲区，并将默认动态缓冲区大小提高至512 MB。

Oossa · 2026-10-08 · https://oossa.com/zh/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

llama.cpp 项目于2026‑10‑08发布 b11490 版本。该版本支持 Hexagon 的“alloc_buffer_n” API，可将大型张量拆分到多个缓冲区中。默认动态缓冲区大小从128 MB提高至512 MB，以避免运行大型模型时性能下降。新增的“--no-embd-offload”标志可简化无法卸载嵌入层的设备所需的命令行参数。这些改动由 Jhen‑Jie Hong 共同完成。

## 事实

- 发布日期：2026‑10‑08（“Thu Oct 08 2026 06:58:59 GMT+0200”）
- 默认动态缓冲区提升至512 MB

## 为什么重要

使用基于 Hexagon 的硬件的开发者无需手动调整缓冲区，就能更高效地运行更大的语言模型。

## 来源与参考

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

最后更新: 2026-10-08
