# В llama.cpp исправили поддержку Q4_K в OpenCL

> Выпуск llama.cpp b11558 от 11 октября 2026 года улучшает работу с изображениями весов Q4_K в OpenCL и исправляет несколько ошибок в ядрах.

Oossa · 2026-10-11 · https://oossa.com/ru/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

11 октября 2026 года проект с открытым исходным кодом llama.cpp выпустил версию b11558. В обновлении исправлена ошибка, из-за которой ядра OpenCL превышали ограничения устройств на размер изображений при использовании квантованных весов Q4_K. Также добавлен запасной путь для устройств, достигающих этих ограничений, и исправлены расчёты широковещательной передачи и RMS-нормализации в ядрах Q4_0. Изменения были подготовлены в соавторстве с Хунцян Ваном из Qualcomm.

## Факты

- Версия b11558 выпущена 2026-10-11
- Исправлено превышение лимита OpenCL на размер изображения в плотных ядрах bin для Q4_K

## Почему это важно

Разработчики, использующие llama.cpp на графических процессорах, теперь смогут запускать квантованные модели Q4_K на большем числе устройств без сбоев.

## Источники и ссылки

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Обновлено: 2026-10-11
