# llama.cpp introduce una nuova API per allocare i buffer nella versione b11351

> L’aggiornamento del 2 ottobre 2026 aggiunge alloc_buffer_n all’interfaccia dei buffer di ggml, migliorando la gestione della memoria su più dispositivi.

Oossa · 2026-10-02 · https://oossa.com/it/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

Il progetto ggml-org/llama.cpp ha rilasciato la versione b11351 il 2026-10-02. L’aggiornamento aggiunge il metodo alloc_buffer_n all’interfaccia ggml_backend_buffer_type_i e introduce l’API pubblica ggml_backend_buft_alloc_buffer_n. L’implementazione predefinita ora supporta la suddivisione dei buffer tra più dispositivi e migliora l’allocazione dei tensori. Per i tipi di buffer esistenti, come CPU, Metal, OpenVINO e altri, il nuovo metodo viene impostato su NULL. Sono stati aggiunti test per verificare la nuova funzionalità.

## I fatti

- La versione b11351 è stata rilasciata il 2026-10-02
- È stato aggiunto il nuovo metodo alloc_buffer_n all’interfaccia dei buffer di ggml

## Perché conta

Gli sviluppatori possono gestire la memoria in modo più affidabile su hardware diversi, riducendo gli errori di allocazione nei modelli di IA.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Ultimo aggiornamento: 2026-10-02
