OossaAI तेज़ी से विकसित हो रहा है। हम इसे आसान भाषा में समझाते हैं।

llama.cpp अपडेट में टेंसर साइज ओवरफ्लो से बचाव

30 सितंबर को जारी अपडेट बड़े टेंसरों में पैडिंग के दौरान होने वाली दुर्लभ ओवरफ्लो समस्या रोकता है और अलग-अलग प्लेटफॉर्म पर स्थिरता बढ़ाता है।

संक्षिप्तOossa1 मिनट पढ़ना

llama.cpp लाइब्रेरी ने 30 सितंबर, 2026 को एक पैच जारी किया, जो पैडिंग के दौरान आकार ओवरफ्लो होने वाले टेंसरों को रोकता है। यह बदलाव पैडिंग जोड़ने से पहले मूल आकार और अलाइनमेंट की जांच करता है और असुरक्षित टेंसरों को शुरू में ही अस्वीकार कर देता है। एक नए टेस्ट केस से पता चलता है कि यह सुधार 2⁶⁴−16 बाइट के उस टेंसर को पकड़ लेता है, जो पहले जांच से बच निकलता था। यह अपडेट macOS से लेकर Windows और Linux तक, CUDA और Vulkan संस्करणों समेत सभी समर्थित बिल्ड पर लागू होता है।

यह क्यों मायने रखता है

यह ओवरफ्लो रुकने से बहुत बड़े मॉडल चलाते समय क्रैश या नतीजों के खराब होने का जोखिम टलता है।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।

स्रोत और संदर्भ

#स्रोतप्रकाशकतारीखमुख्य बात
1ggml-org/llama.cpp b11275 ↗llama.cpp30 सित॰ 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 सित॰ 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 स्रोत

अंतिम अपडेट: ·Markdown·llms.txt