Oossa

В llama.cpp исправили поддержку Q4_K в OpenCL

Выпуск llama.cpp b11558 от 11 октября 2026 года улучшает работу с изображениями весов Q4_K в OpenCL и исправляет несколько ошибок в ядрах.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

11 октября 2026 года проект с открытым исходным кодом llama.cpp выпустил версию b11558. В обновлении исправлена ошибка, из-за которой ядра OpenCL превышали ограничения устройств на размер изображений при использовании квантованных весов Q4_K. Также добавлен запасной путь для устройств, достигающих этих ограничений, и исправлены расчёты широковещательной передачи и RMS-нормализации в ядрах Q4_0. Изменения были подготовлены в соавторстве с Хунцян Ваном из Qualcomm.

Почему это важно

Разработчики, использующие llama.cpp на графических процессорах, теперь смогут запускать квантованные модели Q4_K на большем числе устройств без сбоев.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.