ggml-org выпустила llama.cpp версии b11555. В обновлении исправили ошибку, из-за которой процессоры AVX2 не использовали набор инструкций F16C, даже если он был доступен. Также появились новые бинарные пакеты для macOS на Apple Silicon, macOS на Intel, iOS и нескольких конфигураций Ubuntu, в том числе с поддержкой Vulkan и CUDA 12.8.
Почему это важно
Разработчики, запускающие модели Llama на совместимых процессорах, получат более быстрый инференс без ручного внесения исправлений.