llama.cpp släppte en korrigering den 30 september 2026 som stoppar tensorer vars storlek skulle översvämma vid utfyllnad. Ändringen kontrollerar den råa storleken plus justeringen innan utfyllnaden läggs till, så osäkra tensorer avvisas i ett tidigt skede. Ett nytt testfall visar att korrigeringen fångar en tensor på 2⁶⁴−16 byte som tidigare slank igenom. Uppdateringen gäller alla versioner som stöds, från macOS till Windows och Linux, inklusive CUDA- och Vulkan-versionerna.
Varför det spelar roll
Genom att stoppa den här översvämningen förhindras krascher och felaktiga resultat när mycket stora modeller körs.