# llama.cpp ajoute une nouvelle API d’allocation de tampons dans b11351

> La mise à jour du 2 octobre 2026 ajoute alloc_buffer_n à l’interface des tampons de ggml pour améliorer la gestion de la mémoire sur plusieurs appareils.

Oossa · 2026-10-02 · https://oossa.com/fr/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

Le projet ggml-org/llama.cpp a publié la version b11351 le 2026-10-02. La mise à jour ajoute une méthode alloc_buffer_n à l’interface ggml_backend_buffer_type_i, ainsi qu’une API publique appelée ggml_backend_buft_alloc_buffer_n. L’implémentation par défaut prend désormais en charge la répartition des tampons entre plusieurs appareils et améliore l’allocation des tenseurs. Les types de tampons existants, comme CPU, Metal et OpenVINO, entre autres, reçoivent un pointeur NULL pour cette nouvelle méthode. Des tests ont été ajoutés pour couvrir cette nouvelle fonctionnalité.

## Les faits

- Version b11351 publiée le 2026-10-02
- Nouvelle méthode alloc_buffer_n ajoutée à l’interface des tampons de ggml

## Pourquoi c'est important

Les développeurs peuvent désormais gérer la mémoire de manière plus fiable sur différents matériels, ce qui réduit les erreurs d’allocation dans les modèles d’IA.

## Sources et références

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Dernière mise à jour: 2026-10-02
