Oossa

Обновление llama.cpp возвращает поддержку тензоров K2 Horizon

Выпуск от 9 октября 2026 года устраняет сбой при разделении KV-кэша и возвращает поддержку оборудования K2 Horizon.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

Команда ggml-org выпустила llama.cpp версии b11528 2026-10-09. Теперь библиотека обрабатывает представления тензоров, размещённых в памяти хоста, как обычные узлы. Это устраняет ошибку assert, которая возникала при использовании параметра –split-mode tensor. Кроме того, восстановлена поддержка тензоров SM для ускорителя K2 Horizon. Изменения вошли в официальный релиз на GitHub и доступны для всех перечисленных платформ — от macOS до Windows и Linux.

Почему это важно

Разработчики смогут использовать llama.cpp с разделением KV-кэша на большем числе устройств без сбоев, расширив выбор конфигураций для локального запуска LLM.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.