ggml-org выпустила llama.cpp версии b11537. В обновлении изменён порядок выполнения get_rows в графе для эмбеддингов и исправлена их обработка в Gemma4. Также добавлена пометка TODO о поддержке LoRA и исправлены пути для исходных эмбеддингов. Теперь доступны предварительно собранные бинарные файлы для macOS на Apple Silicon и Intel, iOS и различных сборок Ubuntu, в том числе с поддержкой Vulkan.
Почему это важно
Разработчики могут запускать llama.cpp локально на большем числе платформ и пользоваться исправленной поддержкой эмбеддингов, тратя меньше времени на настройку.