# llama.cpp 업데이트, 호스트 텐서 뷰 지원하고 K2 Horizon 텐서 지원 복구

> 10월 9일 2026년 릴리스에서 KV 캐시 분할 사용 시 발생하던 충돌을 수정하고 K2 Horizon 하드웨어 지원을 복구했습니다.

Oossa · 2026-10-09 · https://oossa.com/ko/llama-cpp-update-adds-host-tensor-view-support-and-re-enables-k2-horizon-tensors

ggml-org 팀이 2026-10-09에 llama.cpp 버전 b11528을 출시했습니다. 이번 업데이트로 라이브러리가 호스트 메모리에 할당된 텐서의 뷰를 일반 노드처럼 처리할 수 있게 돼, –split-mode tensor 옵션 사용 시 발생하던 기존 어서션 오류가 해결됐습니다. K2 Horizon 가속기의 SM 텐서 지원도 다시 추가됐습니다. 이 변경 사항은 공식 GitHub 릴리스에 포함됐으며 macOS, Windows, Linux 등 명시된 모든 플랫폼에 적용됩니다.

## 팩트

- 출시일: 2026‑10‑09 ("Fri Oct 09 2026 16:53:52 GMT+0200")
- –split-mode tensor 사용 시 KV 캐시 뷰 관련 어서션 오류 수정

## 왜 중요한가

개발자는 이제 더 다양한 하드웨어에서 분할 모드 KV 캐시를 사용해 llama.cpp를 충돌 없이 실행할 수 있어, 로컬 LLM 추론에 활용할 수 있는 구성이 늘어납니다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11528](https://github.com/ggml-org/llama.cpp/releases/tag/b11528) – llama.cpp, 2026-10-09

최종 업데이트: 2026-10-09
