# llama.cpp-Update behebt OpenCL-Probleme mit Q4_K-Gewichten

> Die Version b11558 der llama.cpp-Bibliothek vom 11. Oktober 2026 verbessert die OpenCL-Unterstützung für Q4_K-Gewichts-Images und behebt mehrere Kernel-Fehler.

Oossa · 2026-10-11 · https://oossa.com/de/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

Das Open-Source-Projekt llama.cpp hat am 11. Oktober 2026 Version b11558 veröffentlicht. Das Update behebt einen Fehler, durch den OpenCL-Kernels bei quantisierten Q4_K-Gewichten die Image-Limits des Geräts überschreiten konnten. Außerdem gibt es nun einen Ausweichpfad für Geräte, bei denen diese Limits erreicht werden. Darüber hinaus korrigiert das Update Broadcasting- und RMS-Norm-Berechnungen für Q4_0-Kernels. An den Änderungen war auch Hongqiang Wang von Qualcomm als Mitautor beteiligt.

## Die Fakten

- Version b11558 wurde am 11.10.2026 veröffentlicht
- Behebt die OpenCL-Image-Limit-Überschreitung bei dichten Q4_K-Bin-Kernels

## Warum es wichtig ist

Entwickler, die llama.cpp auf GPUs einsetzen, können quantisierte Q4_K-Modelle jetzt auf mehr Hardware ohne Abstürze ausführen.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Zuletzt aktualisiert: 2026-10-11
