# llama.cpp amplia suporte a buffers Hexagon e eleva alocação padrão

> A biblioteca de código aberto llama.cpp agora permite que dispositivos Hexagon dividam tensores grandes e aumenta o buffer dinâmico padrão para 512 MB.

Oossa · 2026-10-08 · https://oossa.com/pt/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

O projeto llama.cpp lançou a versão b11490 em 2026‑10‑08. A atualização adiciona suporte à API "alloc_buffer_n" da Hexagon, permitindo dividir tensores grandes em vários buffers. O tamanho padrão do buffer dinâmico aumenta de 128 MB para 512 MB para evitar quedas de desempenho com modelos grandes. Uma nova opção, "--no-embd-offload", simplifica a linha de comando em dispositivos que não conseguem transferir embeddings. As mudanças foram coescritas por Jhen‑Jie Hong.

## Os fatos

- Data de lançamento: 2026‑10‑08 ("Thu Oct 08 2026 06:58:59 GMT+0200")
- Buffer dinâmico padrão elevado para 512 MB

## Por que importa

Desenvolvedores que usam hardware baseado em Hexagon podem executar modelos de linguagem maiores com mais eficiência, sem precisar ajustar os buffers manualmente.

## Fontes e referências

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Última atualização: 2026-10-08
