Oossa

llama.cpp b11555 behebt CPU-Fehler und bringt neue Builds

Die Open-Source-Inferenzbibliothek Llama erhält mit b11555 ein Update: AVX2-CPUs nutzen nun auch F16C, sofern verfügbar. Außerdem gibt es neue Builds für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

ggml-org hat llama.cpp in Version b11555 veröffentlicht. Das Update behebt einen Fehler, durch den AVX2-CPUs den Befehlssatz F16C nicht nutzten, obwohl er verfügbar war. Außerdem gibt es neue Binärpakete für macOS mit Apple Silicon, macOS mit Intel, iOS und mehrere Ubuntu-Konfigurationen, darunter mit Vulkan- und CUDA-12.8-Unterstützung.

Warum es wichtig ist

Entwickler, die Llama-Modelle auf kompatiblen CPUs ausführen, profitieren von schnellerer Inferenz – ohne manuelle Patches.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.