Oossa

llama.cpp adiciona nova API de alocação de buffers na versão b11351

A atualização de 2 de outubro de 2026 introduz alloc_buffer_n na interface de buffers do ggml, aprimorando o gerenciamento de memória em vários dispositivos.

NotaOossaPublicado pelo Oossa: 1 min de leitura

O projeto ggml‑org/llama.cpp lançou a versão b11351 em 2026-10-02. A atualização adiciona o método alloc_buffer_n à interface ggml_backend_buffer_type_i, com uma API pública chamada ggml_backend_buft_alloc_buffer_n. A implementação padrão agora permite dividir buffers entre vários dispositivos e aprimora a alocação de tensores. Tipos de buffer existentes, como CPU, Metal, OpenVINO e outros, recebem um marcador NULL para o novo método. Foram adicionados testes para cobrir a nova funcionalidade.

Por que importa

Os desenvolvedores agora podem gerenciar a memória com mais confiabilidade em diferentes tipos de hardware, reduzindo erros de alocação em modelos de IA.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.