Команда ggml-org выпустила llama.cpp версии b11461 2026-10-07. Обновление устраняет медленное чтение контрольных точек при использовании Vulkan на встроенных графических процессорах AMD. Также появились новые готовые сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS и нескольких конфигураций Linux (CPU, Vulkan, CUDA 12.8). Подходящий архив можно скачать со страницы релиза на GitHub.
Почему это важно
Пользователи ноутбуков с графикой AMD теперь могут быстрее запускать модели LLaMA без прежнего замедления.