ggml-org hat llama.cpp in Version b11555 veröffentlicht. Das Update behebt einen Fehler, durch den AVX2-CPUs den Befehlssatz F16C nicht nutzten, obwohl er verfügbar war. Außerdem gibt es neue Binärpakete für macOS mit Apple Silicon, macOS mit Intel, iOS und mehrere Ubuntu-Konfigurationen, darunter mit Vulkan- und CUDA-12.8-Unterstützung.
Warum es wichtig ist
Entwickler, die Llama-Modelle auf kompatiblen CPUs ausführen, profitieren von schnellerer Inferenz – ohne manuelle Patches.