Команда ggml‑org выпустила llama.cpp версии b11465. В неё входят готовые бинарные файлы для macOS на Apple Silicon (arm64), macOS на Intel (x64), iOS и нескольких вариантов Ubuntu (CPU, Vulkan и CUDA 12.8). В релиз также вошло изменение теста, позволяющее сохранять якорь при проверке отката рекуррентного состояния. Все файлы доступны для скачивания на странице релиза на GitHub.
Почему это важно
Теперь разработчики могут запускать LLM локально на большем числе устройств, не собирая код самостоятельно.