# llama.cpp adiciona nova API de alocação de buffers na versão b11351

> A atualização de 2 de outubro de 2026 introduz alloc_buffer_n na interface de buffers do ggml, aprimorando o gerenciamento de memória em vários dispositivos.

Oossa · 2026-10-02 · https://oossa.com/pt/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

O projeto ggml‑org/llama.cpp lançou a versão b11351 em 2026-10-02. A atualização adiciona o método alloc_buffer_n à interface ggml_backend_buffer_type_i, com uma API pública chamada ggml_backend_buft_alloc_buffer_n. A implementação padrão agora permite dividir buffers entre vários dispositivos e aprimora a alocação de tensores. Tipos de buffer existentes, como CPU, Metal, OpenVINO e outros, recebem um marcador NULL para o novo método. Foram adicionados testes para cobrir a nova funcionalidade.

## Os fatos

- A versão b11351 foi lançada em 2026‑10‑02
- Novo método alloc_buffer_n adicionado à interface de buffers do ggml

## Por que importa

Os desenvolvedores agora podem gerenciar a memória com mais confiabilidade em diferentes tipos de hardware, reduzindo erros de alocação em modelos de IA.

## Fontes e referências

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Última atualização: 2026-10-02
