# llama.cpp añade una nueva API de asignación de búferes en b11351

> La actualización del 2 de octubre de 2026 incorpora alloc_buffer_n a la interfaz de búferes de ggml para mejorar la gestión de memoria en varios dispositivos.

Oossa · 2026-10-02 · https://oossa.com/es/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

El proyecto ggml‑org/llama.cpp publicó la versión b11351 el 2026-10-02. La actualización añade el método alloc_buffer_n a la interfaz ggml_backend_buffer_type_i, con una API pública llamada ggml_backend_buft_alloc_buffer_n. La implementación predeterminada ahora permite dividir los búferes entre varios dispositivos y mejora la asignación de tensores. Los tipos de búfer existentes, como CPU, Metal y OpenVINO, entre otros, reciben un marcador NULL para el nuevo método. También se añadieron pruebas para cubrir la nueva funcionalidad.

## Los hechos

- La versión b11351 se publicó el 2026-10-02
- Se añadió el nuevo método alloc_buffer_n a la interfaz de búferes de ggml

## Por qué importa

Los desarrolladores ahora pueden gestionar la memoria de forma más fiable en distintos tipos de hardware, lo que reduce los errores de asignación en modelos de IA.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Última actualización: 2026-10-02
