Команда ggml-org выпустила llama.cpp версии b11268. В обновлении исправлена ошибка драйвера OpenCL, из-за которой некорректно обрабатывались тензоры в ядре q5_K для GPU Adreno. Также доступны новые готовые бинарные файлы для Mac с Apple Silicon, компьютеров Mac на базе Intel, iOS и нескольких конфигураций Linux, включая CPU, Vulkan и CUDA 12.8.
Почему это важно
Исправление повышает производительность и стабильность при запуске LLM на устройствах Android с GPU Adreno.