A ggml-org lançou a versão b11537 do llama.cpp. A atualização reorganiza get_rows no grafo para embeddings e corrige o processamento de embeddings do Gemma4. Também acrescenta uma nota de TODO sobre suporte a LoRA e corrige os caminhos de embeddings brutos. Já estão disponíveis binários pré-compilados para macOS com Apple Silicon, macOS com Intel, iOS e várias versões do Ubuntu, incluindo versões com suporte a Vulkan.
Por que importa
Com suporte a embeddings corrigido, desenvolvedores podem executar o llama.cpp localmente em mais plataformas e têm menos trabalho de configuração.