llama.cpp लाइब्रेरी ने 30 सितंबर, 2026 को एक पैच जारी किया, जो पैडिंग के दौरान आकार ओवरफ्लो होने वाले टेंसरों को रोकता है। यह बदलाव पैडिंग जोड़ने से पहले मूल आकार और अलाइनमेंट की जांच करता है और असुरक्षित टेंसरों को शुरू में ही अस्वीकार कर देता है। एक नए टेस्ट केस से पता चलता है कि यह सुधार 2⁶⁴−16 बाइट के उस टेंसर को पकड़ लेता है, जो पहले जांच से बच निकलता था। यह अपडेट macOS से लेकर Windows और Linux तक, CUDA और Vulkan संस्करणों समेत सभी समर्थित बिल्ड पर लागू होता है।
यह क्यों मायने रखता है
यह ओवरफ्लो रुकने से बहुत बड़े मॉडल चलाते समय क्रैश या नतीजों के खराब होने का जोखिम टलता है।