Oossa

افزودن پشتیبانی tinyBLAS از BF16 و FP16 در llama.cpp برای پردازنده‌های x86

کتابخانه متن‌باز llama.cpp حالا دنباله‌های BF16، FP16 و FP32 را در بک‌اند tinyBLAS برداری‌سازی می‌کند تا استنتاج روی CPU سریع‌تر شود.

خبر کوتاهOossaمنتشرشده توسط Oossa: 1 دقیقه مطالعه

تیم ggml‑org نسخه b11398 از llama.cpp را منتشر کرد. این نسخه پردازش دنباله‌های BF16، FP16 و FP32 را در بک‌اند tinyBLAS برای CPUهای مبتنی بر x86 پشتیبانی می‌کند. این دنباله‌ها همچنین برای محاسبات سریع‌تر برداری‌سازی شده‌اند. فایل‌های باینری آماده برای macOS (Apple Silicon و Intel)، iOS و چند معماری Ubuntu ارائه شده‌اند. این به‌روزرسانی شامل اصلاحاتی در آزمون‌هاست تا هنگام استفاده از پیاده‌سازی‌های مرجع، مقایسه‌ها دقیق باشند.

چرا مهم است

توسعه‌دهندگان اکنون می‌توانند بدون شتاب‌دهی GPU، استنتاج مدل‌های زبانی بزرگ را روی پردازنده‌های معمولی سریع‌تر اجرا کنند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.