# В pre-release llama.cpp v0.2.0 ускорили работу на Hexagon

> В открытом LLM-раннере обновили бэкенд Hexagon: операции конкатенации на чипах Snapdragon стали быстрее.

Oossa · 2026-09-30 · https://oossa.com/ru/llama-cpp-v0-2-0-pre-release-adds-hexagon-cpu-optimizations

30 сентября 2026 года проект ggml-org/llama.cpp выпустил предварительную сборку (тег b11272). В ней появилась оптимизация операции конкатенации для Hexagon — распространённого этапа инференса языковых моделей. Изменение сокращает накладные расходы на обработку пакетов и использует более быструю процедуру деления, ускоряя горячий цикл перемещения данных. Обновление входит в более широкий набор сборок для разных платформ, в том числе Android-устройств со Snapdragon и NPU Hexagon.

## Факты

- Тег релиза: b11272 (коммит 7fee178), опубликован 30 сентября 2026 года
- Оптимизация конкатенации для Hexagon сокращает число пакетов и использует быструю инструкцию деления

## Почему это важно

Запуск LLM на смартфонах со Snapdragon станет заметно быстрее, а задержка при выполнении задач ИИ непосредственно на устройстве — ниже.

## Источники и ссылки

1. [ggml-org/llama.cpp b11272](https://github.com/ggml-org/llama.cpp/releases/tag/b11272) – llama.cpp, 2026-09-30

Обновлено: 2026-09-30
