Die llama.cpp-Bibliothek hat am 11. Okt. 2026 Version b11559 veröffentlicht. Sie bringt OpenCL-Verbesserungen für eine schnellere Faktorzuweisung und unterstützt das Decoding von Gemma‑4 auf Qualcomm-E4B- und E2B-GPUs. Außerdem optimiert das Update die DK64- und DK128-Decoding-Pfade für verschiedene Quantisierungseinstellungen. Hongqiang Wang von Qualcomm hat die Änderungen mitverfasst.
Warum es wichtig ist
Entwickler können Gemma‑4-Modelle nun schneller auf kompatiblen Qualcomm-GPUs ausführen und damit die Möglichkeiten für Edge-KI erweitern.