Das llama.cpp-Projekt hat am 30. September 2026 Version b11294 veröffentlicht. Das Update bringt Row-Prefetching für Windows: Die Bibliothek kann Modelldaten im Voraus laden und so die Generierung beschleunigen. Die Änderung stammt von Pranesh Gonegandla und wurde unverändert übernommen. Außerdem enthält das Update kleinere Aufräumarbeiten und Build-Fixes.
Warum es wichtig ist
Dank der neuen Prefetch-Logik können Windows-Nutzer llama.cpp-Modelle schneller ausführen.