ggml-org har släppt llama.cpp version b11537. Uppdateringen ändrar ordningen på get_rows i beräkningsgrafen för embeddings och åtgärdar hanteringen av Gemma4-embeddings. Den lägger också till en TODO-notering om LoRA-stöd och korrigerar sökvägar för råa embeddings. Förkompilerade binärer finns nu för macOS med Apple Silicon, macOS med Intel, iOS och flera Ubuntu-versioner, inklusive versioner med Vulkan-stöd.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp lokalt på fler plattformar med korrigerat stöd för embeddings, vilket gör installationen enklare.