Команда ggml-org выпустила llama.cpp b11496 8 октября 2026 года. Обновление добавляет этап SYCL, который передаёт пакетные загрузки моделей через закреплённый кольцевой буфер, ускоряя загрузку на совместимых GPU. Для скачивания доступны сборки для macOS (Apple Silicon и Intel), iOS и различных версий Ubuntu (CPU, Vulkan, CUDA 12).
Почему это важно
Разработчики смогут быстрее загружать большие языковые модели на оборудовании, совместимом с SYCL, сокращая время запуска приложений на базе llama.cpp.