# llama.cpp更新支持主机张量视图，并重新启用K2 Horizon张量

> 2026年10月9日发布的版本修复了使用KV缓存拆分时发生的崩溃，并恢复对K2 Horizon硬件的支持。

Oossa · 2026-10-09 · https://oossa.com/zh/llama-cpp-update-adds-host-tensor-view-support-and-re-enables-k2-horizon-tensors

ggml-org团队于2026-10-09发布llama.cpp b11528版。此次更新让该库可以将主机分配张量的视图视为普通节点，从而避免使用–split-mode tensor选项时出现此前的断言错误。此外，更新还重新加入了对K2 Horizon加速器的SM张量支持。相关改动已包含在GitHub官方版本中，适用于列出的所有平台，包括macOS、Windows和Linux。

## 事实

- 发布日期：2026-10-09（“Fri Oct 09 2026 16:53:52 GMT+0200”）
- 修复使用–split-mode tensor时KV缓存视图触发的断言错误

## 为什么重要

开发者现在可以在更多硬件上使用拆分模式KV缓存运行llama.cpp，而不会遭遇崩溃，从而为本地LLM推理提供更多可用配置。

## 来源与参考

1. [ggml-org/llama.cpp b11528](https://github.com/ggml-org/llama.cpp/releases/tag/b11528) – llama.cpp, 2026-10-09

最后更新: 2026-10-09
