Библиотека с открытым исходным кодом llama.cpp выпустила версию b11511 8 октября 2026 года. В ней исправлена ошибка чтения за пределами допустимого диапазона в реализации MMQ для CUDA. Также добавлены готовые к запуску бинарные сборки для macOS (Apple Silicon и Intel), iOS и Ubuntu для x64, arm64 и s390x, а также сборки с поддержкой Vulkan и CUDA 12.8.
Почему это важно
Теперь разработчики могут запускать llama.cpp на большем числе устройств без сбоев — особенно те, кто использует видеокарты NVIDIA.