# llama.cpp añade compatibilidad con buffers Hexagon y amplía la asignación predeterminada

> La biblioteca de código abierto llama.cpp permite ahora que los dispositivos Hexagon dividan tensores grandes y aumenta el tamaño predeterminado del buffer dinámico a 512 MB.

Oossa · 2026-10-08 · https://oossa.com/es/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

El proyecto llama.cpp publicó la versión b11490 el 2026‑10‑08. Añade compatibilidad con la API «alloc_buffer_n» de Hexagon, que permite dividir tensores grandes entre varios buffers. El tamaño predeterminado del buffer dinámico aumenta de 128 MB a 512 MB para evitar caídas de rendimiento con modelos grandes. Una nueva opción «--no-embd-offload» simplifica los comandos en dispositivos que no pueden descargar las capas de embeddings. Jhen‑Jie Hong colaboró en estos cambios.

## Los hechos

- Fecha de lanzamiento: 2026‑10‑08 («Thu Oct 08 2026 06:58:59 GMT+0200»)
- El tamaño predeterminado del buffer dinámico aumenta a 512 MB

## Por qué importa

Los desarrolladores que usan hardware basado en Hexagon pueden ejecutar modelos de lenguaje más grandes y con mayor eficiencia, sin tener que ajustar los buffers manualmente.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Última actualización: 2026-10-08
