# llama.cpp ускоряет Vulkan за счёт обработки повторяющихся строк

> Библиотека llama.cpp с открытым исходным кодом теперь пропускает лишние вычисления при повторении строк на GPU, ускоряя работу на устройствах с Vulkan.

Oossa · 2026-10-11 · https://oossa.com/ru/llama-cpp-adds-vulkan-duplicate-row-optimizations

Проект llama.cpp выпустил версию b11554 2026‑10‑11. В обновлении появились специальные для Vulkan исправления: библиотека выявляет повторяющиеся идентификаторы строк при умножении матриц и обрабатывает их на предварительном этапе, не перебирая по очереди. Также улучшена оптимизация «hoist row ids»: теперь она запускается всегда и может формировать несколько компактных тайлов. Благодаря этим изменениям GPU запускает меньше рабочих групп и, когда это возможно, завершает работу раньше.

## Факты

- Версия b11554 выпущена в воскресенье, 11 октября 2026 года
- В llama.cpp добавлена обработка повторяющихся строк для Vulkan

## Почему это важно

На GPU inference в llama.cpp может выполняться быстрее, поскольку библиотека больше не повторяет одни и те же вычисления.

## Источники и ссылки

1. [ggml-org/llama.cpp b11554](https://github.com/ggml-org/llama.cpp/releases/tag/b11554) – llama.cpp, 2026-10-11

Обновлено: 2026-10-11
