# llama.cpp b11489 beschleunigt Q6_K-Dekodierung

> Version b11489 beschleunigt die Dekodierung von Q6_K-Gewichten und erweitert das Unrolling. Neue Binärdateien gibt es für macOS, iOS und Linux.

Oossa · 2026-10-08 · https://oossa.com/de/llama-cpp-release-adds-q6-k-weight-dequant-speedup

Das Team von ggml-org hat llama.cpp in Version b11489 veröffentlicht. Das Update beschleunigt die Dekodierung von Q6_K-Gewichten – dabei werden komprimierte Modellgewichte wieder in nutzbare Zahlen umgewandelt – und verdoppelt laut den Versionshinweisen den Unrolling-Faktor. Vorgefertigte Binärdateien sind jetzt für Apple Silicon, Intel-Macs, iOS und verschiedene Ubuntu-Konfigurationen verfügbar, darunter Builds mit Vulkan und CUDA.

## Die Fakten

- Release-Tag: b11489
- Veröffentlicht: Thu Oct 08 2026

## Warum es wichtig ist

Durch die schnellere Dekodierung können Entwickler LLMs auf derselben Hardware mit geringerer Latenz ausführen.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11489](https://github.com/ggml-org/llama.cpp/releases/tag/b11489) – llama.cpp, 2026-10-08

Zuletzt aktualisiert: 2026-10-08
