Команда ggml‑org выпустила llama.cpp версии b11501 8 октября 2026 года. Обновление включает оптимизации быстрого преобразования Уолша — Адамара для SYCL (кроссплатформенного API для вычислений), которые могут ускорить некоторые матричные операции. Кроме того, доступны готовые к запуску сборки для macOS на Apple Silicon, macOS на Intel, iOS и Ubuntu с поддержкой CPU, Vulkan и CUDA 12.8.
Почему это важно
Теперь разработчики могут быстрее запускать модели Llama на GPU с поддержкой SYCL и обходиться без самостоятельной сборки библиотеки.