# llama.cpp unterstützt jetzt Row-Prefetching unter Windows

> Die Open-Source-Bibliothek llama.cpp lädt Modellzeilen unter Windows nun im Voraus und beschleunigt so die Inferenz auf dieser Plattform.

Oossa · 2026-09-30 · https://oossa.com/de/llama-cpp-adds-windows-row-prefetch-support

Das llama.cpp-Projekt hat am 30. September 2026 Version b11294 veröffentlicht. Das Update bringt Row-Prefetching für Windows: Die Bibliothek kann Modelldaten im Voraus laden und so die Generierung beschleunigen. Die Änderung stammt von Pranesh Gonegandla und wurde unverändert übernommen. Außerdem enthält das Update kleinere Aufräumarbeiten und Build-Fixes.

## Die Fakten

- Veröffentlichungsdatum: 2026-09-30 ("Wed Sep 30 2026 20:14:41 GMT+0200")
- Funktion: Row-Prefetching unter Windows

## Warum es wichtig ist

Dank der neuen Prefetch-Logik können Windows-Nutzer llama.cpp-Modelle schneller ausführen.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11294](https://github.com/ggml-org/llama.cpp/releases/tag/b11294) – llama.cpp, 2026-09-30

Zuletzt aktualisiert: 2026-09-30
