# llama.cpp prend en charge les buffers Hexagon et augmente leur taille par défaut

> La bibliothèque open source llama.cpp permet désormais aux appareils Hexagon de répartir les grands tenseurs entre plusieurs buffers et porte à 512 MB la taille du buffer dynamique par défaut.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-adds-hexagon-buffer-support-and-larger-default-allocation

Le projet llama.cpp a publié la version b11490 le 2026‑10‑08. Elle prend en charge l’API « alloc_buffer_n » de Hexagon, qui permet de répartir les grands tenseurs entre plusieurs buffers. La taille du buffer dynamique par défaut passe de 128 MB à 512 MB afin d’éviter les baisses de performances avec les grands modèles. Un nouveau paramètre « --no-embd-offload » simplifie les lignes de commande pour les appareils qui ne peuvent pas décharger les embeddings. Jhen‑Jie Hong a contribué à ces changements.

## Les faits

- Date de sortie : 2026‑10‑08 (« Thu Oct 08 2026 06:58:59 GMT+0200 »)
- La taille du buffer dynamique par défaut passe à 512 MB

## Pourquoi c'est important

Les développeurs qui utilisent du matériel basé sur Hexagon peuvent exécuter de plus grands modèles de langage plus efficacement, sans avoir à régler manuellement les buffers.

## Sources et références

1. [ggml-org/llama.cpp b11490](https://github.com/ggml-org/llama.cpp/releases/tag/b11490) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
