Команда ggml‑org выпустила llama.cpp b11515 9 октября 2026 года. В обновлении появились перемножение матрицы на вектор с квантованием (MMVQ) и переупорядоченной раскладкой Q5_K на базе SYCL, а также объединённый оператор GLU — это повышает производительность на совместимом оборудовании. В релиз также вошли готовые к запуску сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) и IBM s390x. Подходящий архив можно скачать со страницы проекта на GitHub.
Почему это важно
Разработчики смогут быстрее запускать llama.cpp на совместимых с SYCL графических процессорах, не собирая программу из исходного кода.