Projektet llama.cpp släppte version b11294 den 30 september 2026. Uppdateringen lägger till radförhämtning i Windows, vilket innebär att biblioteket kan läsa in modelldata i förväg för att snabba upp genereringen. Ändringen bidrog Pranesh Gonegandla med, och den slogs samman utan ytterligare ändringar. Uppdateringen innehåller också mindre städning och byggfixar.
Varför det spelar roll
Windows-användare av llama.cpp får snabbare modellinferens tack vare den nya förhämtningslogiken.