ggml-org hat llama.cpp in Version b11537 veröffentlicht. Das Update ordnet get_rows im Rechengraphen für Embeddings neu und behebt Fehler bei der Verarbeitung von Gemma4-Embeddings. Außerdem enthält es einen TODO-Hinweis zur LoRA-Unterstützung und korrigiert Pfade für Raw-Embeddings. Vorkompilierte Binärdateien sind jetzt für macOS mit Apple Silicon, macOS mit Intel-Prozessoren, iOS und verschiedene Ubuntu-Versionen verfügbar, darunter auch Varianten mit Vulkan-Unterstützung.
Warum es wichtig ist
Entwickler können llama.cpp jetzt auf mehr Plattformen lokal ausführen und profitieren von korrigierter Embedding-Unterstützung. Das erspart ihnen Einrichtungsaufwand.