ggml‑org выпустила версию b11539 llama.cpp — лёгкого инструмента для запуска больших языковых моделей на множестве устройств. Новые архивы доступны для macOS на Apple Silicon и Intel, iOS XCFramework, а также для нескольких сборок Ubuntu с поддержкой CPU, Vulkan и CUDA 12.8. Ссылки на загрузку опубликованы на странице релиза в GitHub.
Почему это важно
Разработчики теперь могут запускать llama.cpp локально на большем числе устройств, не собирая программу самостоятельно.