Oossa

llama.cpp volta a oferecer suporte a tensores K2 Horizon

A versão de 9 de outubro de 2026 corrige uma falha ao dividir o cache KV e restaura o suporte a tensores para o hardware K2 Horizon.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml-org lançou a versão b11528 do llama.cpp em 2026-10-09. A atualização permite que a biblioteca trate visualizações de tensores alocados na memória do host como nós normais, eliminando um erro de assert que ocorria com a opção –split-mode tensor. Também restaura o suporte a tensores SM para o acelerador K2 Horizon. A alteração está incluída na versão oficial do GitHub e se aplica a todas as plataformas listadas, de macOS a Windows e Linux.

Por que importa

Agora, desenvolvedores podem executar o llama.cpp com o cache KV dividido em mais tipos de hardware, sem falhas, ampliando as configurações disponíveis para inferência local de LLMs.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.