Команда ggml-org выпустила llama.cpp версии b11270 30 сентября 2026 года. В релизе изменена операция для GPU на платформе AMD HIP: более медленная инструкция вычитания байтов заменена на более быструю. Также добавлены новые бинарные пакеты для macOS (Apple Silicon и Intel), iOS и нескольких сборок Ubuntu, в том числе версий с поддержкой GPU через Vulkan.
Почему это важно
Оптимизация GPU может ускорить инференс на оборудовании AMD, а готовые бинарные сборки упрощают разработчикам знакомство с llama.cpp на большем числе платформ.