ggml-org heeft versie b11537 van llama.cpp uitgebracht. De update past de volgorde van get_rows in de grafiek aan voor embeddings en lost problemen met de verwerking van Gemma4-embeddings op. Ook is een TODO-opmerking voor LoRA-ondersteuning toegevoegd en zijn paden voor ruwe embeddings gecorrigeerd. Er zijn nu vooraf gecompileerde binaries beschikbaar voor macOS met Apple Silicon, macOS met Intel, iOS en verschillende Ubuntu-builds, waaronder versies met Vulkan-ondersteuning.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu op meer platforms lokaal gebruiken, met verbeterde ondersteuning voor embeddings en minder gedoe bij de installatie.