Команда ggml-org выпустила версию llama.cpp b11322 1 октября 2026 года. В обновление вошли готовые сборки для macOS на Apple Silicon и Intel, iOS и нескольких вариантов Ubuntu — для CPU, Vulkan и CUDA. Также исправлена гонка в компоненте hex-workqueue. Скачать сборки можно по прямым ссылкам на странице релиза на GitHub.
Почему это важно
Теперь разработчики могут запускать llama.cpp локально на большем числе платформ, не собирая программу из исходного кода, что ускоряет тестирование и развёртывание.