Команда ggml-org выпустила llama.cpp b11277. В обновлении исправлена ошибка сброса буфера, приводившая к утечкам памяти. Также доступны готовые сборки для macOS (Apple Silicon и Intel), iOS и нескольких вариантов Ubuntu, в том числе с поддержкой Vulkan и CUDA. Скачать файлы можно прямо со страницы релиза.
Почему это важно
Исправление утечки повышает стабильность при локальном запуске больших языковых моделей, а готовые сборки упрощают знакомство с llama.cpp на разных платформах.