De llama.cpp-bibliotheek bracht op 30 september 2026 een patch uit die tensors blokkeert waarvan de grootte tijdens het opvullen zou overlopen. De wijziging controleert de ruwe grootte plus de uitlijning voordat er opvulling wordt toegevoegd, en weigert onveilige tensors direct. Een nieuwe test laat zien dat de oplossing een tensor van 2⁶⁴−16 bytes onderschept die eerder niet werd tegengehouden. De update geldt voor alle ondersteunde builds, van macOS tot Windows en Linux, inclusief de CUDA- en Vulkan-versies.
Waarom het ertoe doet
Door deze overflow te voorkomen, worden crashes of beschadigde resultaten voorkomen bij het draaien van zeer grote modellen.