# llama.cpp исправляет обработку BF16 на CPU

> В выпуске b11292 добавлена поддержка на CPU матричного входа BF16 для глубинной свёртки и уточнены проверки поддержки в Vulkan.

Oossa · 2026-09-30 · https://oossa.com/ru/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

Создано и переведено с помощью ИИ. Проверьте первоисточники ниже.

В выпуске llama.cpp b11292 устранено ограничение CPU-бэкенда, влиявшее на глубинную одномерную свёртку с ядром в формате BF16 — 16-битном числовом формате. Теперь CPU-бэкенд преобразует такой вход в 32-битное число с плавающей запятой для вычислений, как и ядро умножения матрицы на вектор в Metal.

В выпуске также изменены проверки Vulkan: BF16 принимается в качестве второго матричного входа, только если первый вход тоже имеет формат BF16. Другие сочетания помечаются как неподдерживаемые, поэтому планировщик выполняет их на CPU. В примечаниях упоминаются добавленные тесты, но не указано, когда изменения появятся в готовом приложении и какие пользователи их получат.

## Факты

- Выпуск llama.cpp b11292 опубликован 30 сентября 2026 года.
- В примечаниях описаны тест глубинной свёртки с ядрами F32, F16 и BF16, а также три случая умножения матриц, где второй вход имеет формат BF16.

## Почему это важно

Разработчики, использующие глубинную свёртку BF16, теперь могут выполнять на CPU комбинацию, которую этот бэкенд раньше отклонял. В примечаниях не указано, когда исправление появится в приложениях, использующих llama.cpp.

## Источники и ссылки

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

Обновлено: 2026-09-30
