Команда ggml‑org выпустила llama.cpp версии b11471. В словарь моделей добавлен новый набор из 30090 токенов plamo fim. В релиз также вошли готовые к запуску бинарные файлы для macOS на Apple Silicon, macOS на Intel, iOS и нескольких сборок Linux (CPU, Vulkan, CUDA 12.8). Подходящий пакет можно скачать со страницы релиза на GitHub.
Почему это важно
Теперь разработчики могут запускать llama.cpp локально на большем числе устройств без сборки из исходного кода — это экономит время и упрощает тестирование.