# llama.cpp unterstützt AVX512‑FP16-Dot-Produkte in Version b11262

> Die Open-Source-Bibliothek llama.cpp nutzt jetzt AVX512‑FP16, um Dot-Produkte mit halber Genauigkeit in voller Genauigkeit zu berechnen und so die CPU-Leistung zu verbessern.

Oossa · 2026-09-29 · https://oossa.com/de/llama-cpp-adds-avx512-fp16-dot-product-support-in-b11262-release

Das Team von ggml-org hat am 29. September 2026 llama.cpp in Version b11262 veröffentlicht. Das Update ergänzt die Unterstützung für AVX512‑FP16. Damit lassen sich Dot-Produkte mit halber Genauigkeit (f16) berechnen und die Ergebnisse für höhere Genauigkeit mit einfacher Genauigkeit (f32) aufsummieren. Die Änderung auf niedriger Ebene beschleunigt die Inferenz auf CPUs, die den Befehlssatz AVX512‑FP16 unterstützen. Außerdem enthält die Veröffentlichung neue Binärdateien für macOS, iOS und mehrere Linux-Varianten.

## Die Fakten

- Version b11262 wurde am 29. September 2026 veröffentlicht
- Ergänzt die Akkumulation von AVX512‑FP16-Dot-Produkten in f32

## Warum es wichtig ist

Entwickler können damit LLMs auf modernen CPUs schneller ausführen, ohne Einbußen bei der numerischen Genauigkeit.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11262](https://github.com/ggml-org/llama.cpp/releases/tag/b11262) – llama.cpp, 2026-09-29

Zuletzt aktualisiert: 2026-09-29
