Команда ggml‑org выпустила llama.cpp версии b11498 2026‑10‑08. В обновлении исправлена проблема с ядром CUDA, возникавшая, когда размеры некоторых тензоров превышали ограничения сетки GPU. Также добавлены новые предварительно скомпилированные сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS и нескольких конфигураций Ubuntu, включая варианты для CPU, Vulkan и CUDA 12.8.
Почему это важно
Теперь разработчики смогут запускать llama.cpp на большем числе конфигураций GPU без сбоев и использовать готовые сборки для своей платформы.