# llama.cpp увеличила буфер по умолчанию и добавила поддержку Hexagon

> В библиотеке с открытым исходным кодом llama.cpp устройства Hexagon теперь могут разбивать большие тензоры на несколько буферов, а размер динамического буфера по умолчанию увеличен до 512 MB.

Oossa · 2026-10-08 · https://oossa.com/ru/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

Проект llama.cpp выпустил версию b11490 2026‑10‑08. В ней добавлена поддержка API Hexagon «alloc_buffer_n», позволяющего разбивать большие тензоры на несколько буферов. Размер динамического буфера по умолчанию увеличен со 128 MB до 512 MB, чтобы избежать падения производительности при работе с большими моделями. Новый флаг «--no-embd-offload» упрощает командную строку для устройств, которые не могут переносить вычисления с эмбеддингами. Изменения также подготовил Jhen‑Jie Hong.

## Факты

- Дата выпуска: 2026‑10‑08 («Thu Oct 08 2026 06:58:59 GMT+0200»)
- Размер динамического буфера по умолчанию увеличен до 512 MB

## Почему это важно

Разработчики, использующие оборудование на базе Hexagon, смогут эффективнее запускать более крупные языковые модели без ручной настройки буфера.

## Источники и ссылки

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Обновлено: 2026-10-08
