# В llama.cpp ускорили деквантизацию весов Q6_K

> В версии b11489 ускорили деквантизацию весов Q6_K и увеличили фактор развёртки циклов. Также доступны новые бинарные сборки для macOS, iOS и Linux.

Oossa · 2026-10-08 · https://oossa.com/ru/llama-cpp-release-adds-q6-k-weight-dequant-speedup

Команда ggml‑org выпустила llama.cpp версии b11489. В обновлении ускорили деквантизацию весов Q6_K — преобразование сжатых весов модели обратно в числа, пригодные для использования, — и вдвое увеличили фактор развёртки циклов, говорится в примечаниях к выпуску. Теперь доступны готовые бинарные сборки для Apple Silicon, Intel macOS, iOS, а также нескольких конфигураций Ubuntu, включая сборки с Vulkan и CUDA.

## Факты

- Тег релиза: b11489
- Опубликовано: Thu Oct 08 2026

## Почему это важно

Благодаря более быстрой деквантизации разработчики смогут запускать LLM на том же оборудовании с меньшей задержкой.

## Источники и ссылки

1. [ggml-org/llama.cpp b11489](https://github.com/ggml-org/llama.cpp/releases/tag/b11489) – llama.cpp, 2026-10-08

Обновлено: 2026-10-08
