OossaKI entwickelt sich schnell. Wir erklären es einfach.

llama.cpp unterstützt AVX512‑FP16-Dot-Produkte in Version b11262

Die Open-Source-Bibliothek llama.cpp nutzt jetzt AVX512‑FP16, um Dot-Produkte mit halber Genauigkeit in voller Genauigkeit zu berechnen und so die CPU-Leistung zu verbessern.

KurzmeldungOossa1 Min. Lesezeit

Das Team von ggml-org hat am 29. September 2026 llama.cpp in Version b11262 veröffentlicht. Das Update ergänzt die Unterstützung für AVX512‑FP16. Damit lassen sich Dot-Produkte mit halber Genauigkeit (f16) berechnen und die Ergebnisse für höhere Genauigkeit mit einfacher Genauigkeit (f32) aufsummieren. Die Änderung auf niedriger Ebene beschleunigt die Inferenz auf CPUs, die den Befehlssatz AVX512‑FP16 unterstützen. Außerdem enthält die Veröffentlichung neue Binärdateien für macOS, iOS und mehrere Linux-Varianten.

Warum es wichtig ist

Entwickler können damit LLMs auf modernen CPUs schneller ausführen, ohne Einbußen bei der numerischen Genauigkeit.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1ggml-org/llama.cpp b11262 ↗llama.cpp29.09.2026<details open> ggml : accumulate f16 dot products in f32 on AVX512-FP16 (#29545) Supersedes #29530 Signed-off-by: Adrien Gallouët <angt@hugg

1 Quellen

Zuletzt aktualisiert: ·Markdown·llms.txt