# llama.cpp får nytt API för buffertallokering i b11351

> Uppdateringen den 2 okt. 2026 lägger till alloc_buffer_n i ggml:s buffertgränssnitt och förbättrar minneshanteringen på flera enheter.

Oossa · 2026-10-02 · https://oossa.com/sv/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

Projektet ggml‑org/llama.cpp släppte version b11351 den 2026-10-02. Uppdateringen lägger till metoden alloc_buffer_n i gränssnittet ggml_backend_buffer_type_i, med det publika API:et ggml_backend_buft_alloc_buffer_n. Standardimplementeringen stöder nu uppdelning av buffertar mellan flera enheter och bättre tensorallokering. Befintliga bufferttyper som CPU, Metal, OpenVINO och andra får en NULL-platshållare för den nya metoden. Tester har lagts till för att täcka den nya funktionen.

## Fakta

- Version b11351 släpptes den 2026-10-02
- En ny metod, alloc_buffer_n, har lagts till i ggml:s buffertgränssnitt

## Varför det spelar roll

Utvecklare kan nu hantera minne mer tillförlitligt på olika typer av hårdvara, vilket minskar allokeringsfel i AI-modeller.

## Källor och referenser

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Senast uppdaterad: 2026-10-02
