Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

به‌روزرسانی llama.cpp از سرریز اندازه تِنسر جلوگیری می‌کند

نسخه منتشرشده در ۳۰ سپتامبر با رفع یک باگ نادر هنگام هم‌ترازسازی تِنسرهای بزرگ، پایداری را در پلتفرم‌های مختلف افزایش می‌دهد.

خبر کوتاهOossa1 دقیقه مطالعه

کتابخانه llama.cpp در ۳۰ سپتامبر ۲۰۲۶ وصله‌ای منتشر کرد که تِنسرهایی را که اندازه‌شان هنگام هم‌ترازسازی سرریز می‌کند، رد می‌کند. این تغییر پیش از افزودن فضای هم‌ترازی، اندازه خام را به‌علاوه مقدار هم‌ترازی بررسی می‌کند و تِنسرهای ناایمن را زودتر کنار می‌گذارد. یک مورد آزمایشی جدید نشان می‌دهد که این اصلاح، تِنسر 2⁶⁴−16 بایتی را که پیش‌تر از بررسی عبور می‌کرد، شناسایی می‌کند. این به‌روزرسانی برای همه نسخه‌های پشتیبانی‌شده، از macOS تا Windows و Linux، از جمله نسخه‌های CUDA و Vulkan اعمال می‌شود.

چرا مهم است

جلوگیری از این سرریز مانع از خرابی یا تولید نتایج نادرست هنگام اجرای مدل‌های بسیار بزرگ می‌شود.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ggml-org/llama.cpp b11275 ↗llama.cpp۸ مهر ۱۴۰۵<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp۸ مهر ۱۴۰۵<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt