ggml‑org выпустил llama.cpp версии b11466 7 октября 2026 года. Обновление исправляет проверку supports_op в flash_attn для перекрывающихся пар ключ—значение. Также добавлены готовые к запуску сборки для macOS на Apple Silicon и Intel, iOS и нескольких вариантов Ubuntu (CPU, Vulkan и CUDA 12.8). Файлы можно скачать со страницы релиза на GitHub.
Почему это важно
Разработчики могут запускать актуальную версию llama.cpp на большем числе платформ, не собирая её из исходного кода.