Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

پشتیبانی llama.cpp از AVX512‑FP16 در نسخه b11262

کتابخانه متن‌باز llama.cpp اکنون با استفاده از AVX512‑FP16، ضرب داخلی با دقت نیمه را با دقت کامل محاسبه می‌کند و عملکرد پردازنده را بهبود می‌دهد.

خبر کوتاهOossa1 دقیقه مطالعه

تیم ggml‑org در ۲۹ سپتامبر ۲۰۲۶ نسخه b11262 از llama.cpp را منتشر کرد. این به‌روزرسانی پشتیبانی از AVX512‑FP16 را اضافه می‌کند؛ مجموعه‌دستورالعملی که ضرب داخلی با دقت نیمه (f16) را انجام می‌دهد، اما حاصل‌ها را برای دقت بیشتر با دقت تک‌ (f32) انباشته می‌کند. این تغییر در سطح پایین، استنتاج را روی پردازنده‌هایی که از مجموعه‌دستورالعمل AVX512‑FP16 پشتیبانی می‌کنند، سریع‌تر می‌کند. این نسخه همچنین فایل‌های اجرایی تازه‌ای برای macOS، iOS و چندین نسخه لینوکس ارائه می‌دهد.

چرا مهم است

این قابلیت به توسعه‌دهندگان امکان می‌دهد مدل‌های زبانی بزرگ را روی پردازنده‌های جدیدتر سریع‌تر اجرا کنند، بی‌آنکه از دقت محاسباتی کاسته شود.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ggml-org/llama.cpp b11262 ↗llama.cpp۷ مهر ۱۴۰۵<details open> ggml : accumulate f16 dot products in f32 on AVX512-FP16 (#29545) Supersedes #29530 Signed-off-by: Adrien Gallouët <angt@hugg

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt