Das Team von ggml-org hat am 8. Oktober 2026 llama.cpp in Version b11486 veröffentlicht. Das Update verbessert die Genauigkeit der GELU-Aktivierungsfunktion, eines kleinen mathematischen Bausteins, der in vielen Sprachmodellen zum Einsatz kommt. Außerdem gibt es vorkompilierte Binärdateien für Apple Silicon, Intel-Macs, iOS und verschiedene Ubuntu-Konfigurationen (CPU, Vulkan, CUDA). Die Binärdateien lassen sich direkt von der Release-Seite herunterladen.
Warum es wichtig ist
Entwickler können LLaMA-Modelle auf ihren eigenen Geräten schneller und mit präziseren Berechnungen ausführen.