# llama.cpp volta a oferecer suporte a tensores K2 Horizon

> A versão de 9 de outubro de 2026 corrige uma falha ao dividir o cache KV e restaura o suporte a tensores para o hardware K2 Horizon.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-update-adds-host-tensor-view-support-and-re-enables-k2-horizon-tensors

A equipe ggml-org lançou a versão b11528 do llama.cpp em 2026-10-09. A atualização permite que a biblioteca trate visualizações de tensores alocados na memória do host como nós normais, eliminando um erro de assert que ocorria com a opção –split-mode tensor. Também restaura o suporte a tensores SM para o acelerador K2 Horizon. A alteração está incluída na versão oficial do GitHub e se aplica a todas as plataformas listadas, de macOS a Windows e Linux.

## Os fatos

- Data de lançamento: 2026-10-09 ("Fri Oct 09 2026 16:53:52 GMT+0200")
- Corrige erro de assert em visualizações do cache KV ao usar –split-mode tensor

## Por que importa

Agora, desenvolvedores podem executar o llama.cpp com o cache KV dividido em mais tipos de hardware, sem falhas, ampliando as configurações disponíveis para inferência local de LLMs.

## Fontes e referências

1. [ggml-org/llama.cpp b11528](https://github.com/ggml-org/llama.cpp/releases/tag/b11528) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
