# llama.cpp prend en charge les vues de tenseurs hôtes et rétablit K2 Horizon

> La version du 9 octobre 2026 corrige un plantage lié au fractionnement du cache KV et rétablit la prise en charge des tenseurs K2 Horizon.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-update-adds-host-tensor-view-support-and-re-enables-k2-horizon-tensors

L’équipe ggml-org a publié la version b11528 de llama.cpp le 2026-10-09. Cette mise à jour permet à la bibliothèque de traiter les vues de tenseurs alloués sur l’hôte comme des nœuds ordinaires, évitant ainsi une erreur d’assertion qui survenait avec l’option –split-mode tensor. Elle rétablit également la prise en charge des tenseurs SM pour l’accélérateur K2 Horizon. Ce changement figure dans la version officielle sur GitHub et concerne toutes les plateformes répertoriées, de macOS à Windows et Linux.

## Les faits

- Date de sortie : 2026-10-09 (« Fri Oct 09 2026 16:53:52 GMT+0200 »)
- Corrige une erreur d’assertion sur les vues du cache KV avec l’option –split-mode tensor

## Pourquoi c'est important

Les développeurs peuvent désormais utiliser llama.cpp avec le cache KV en mode fractionné sur davantage de matériel sans plantage, ce qui élargit les configurations possibles pour l’inférence de LLM en local.

## Sources et références

1. [ggml-org/llama.cpp b11528](https://github.com/ggml-org/llama.cpp/releases/tag/b11528) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
