# llama.cpp unterstützt Host-Tensor-Ansichten und wieder K2-Horizon-Tensoren

> Das Release vom 9. Okt. 2026 behebt einen Absturz bei KV-Cache-Aufteilungen und stellt die Unterstützung für K2-Horizon-Hardware wieder her.

Oossa · 2026-10-09 · https://oossa.com/de/llama-cpp-update-adds-host-tensor-view-support-and-re-enables-k2-horizon-tensors

Das Team von ggml-org hat am 9. Okt. 2026 llama.cpp Version b11528 veröffentlicht. Mit dem Update behandelt die Bibliothek Ansichten hostallokierter Tensoren wie normale Knoten. Dadurch wird ein früherer Assertion-Fehler verhindert, der bei der Option –split-mode tensor auftrat. Außerdem wird die SM-Tensor-Unterstützung für den Beschleuniger K2 Horizon wieder eingeführt. Die Änderung ist im offiziellen GitHub-Release enthalten und gilt für alle aufgeführten Plattformen – von macOS bis Windows und Linux.

## Die Fakten

- Veröffentlichungsdatum: 2026‑10‑09 ("Fri Oct 09 2026 16:53:52 GMT+0200")
- Behebt einen Assertion-Fehler bei KV-Cache-Ansichten mit –split-mode tensor

## Warum es wichtig ist

Entwickler können llama.cpp nun mit aufgeteiltem KV-Cache auf mehr Hardware ohne Abstürze nutzen. Dadurch stehen für die lokale LLM-Inferenz mehr Konfigurationen zur Verfügung.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11528](https://github.com/ggml-org/llama.cpp/releases/tag/b11528) – llama.cpp, 2026-10-09

Zuletzt aktualisiert: 2026-10-09
