Oossa

llama.cpp erhält BF16-Unterstützung und neue Ops

Die Open-Source-Bibliothek llama.cpp unterstützt jetzt BF16-Datentyp-Operationen und GLU – für mehr Leistung auf CPU und CUDA.

KurzmeldungOossaVon Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat llama.cpp in Version b11293 veröffentlicht. Neu sind unäre BF16-Operationen (BF16 ist ein Zahlenformat mit halber Genauigkeit), GLU-, binäre und Skalierungsoperationen für CPU und CUDA. Außerdem wurden die CUDA-Kernels aktualisiert, um ein BF16-Problem beim Erstellen zu beheben. Das Update ist für zahlreiche Plattformen verfügbar, darunter macOS, Windows, Linux und Android.

Warum es wichtig ist

Entwickler können llama.cpp-Modelle nun auf BF16-fähiger Hardware wie neueren GPUs schneller ausführen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.