Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

انتشار llama.cpp b11268 با رفع مشکل OpenCL در Adreno

این اجراکننده متن‌باز مدل‌های زبانی بزرگ، کد OpenCL خود را برای اصلاح پردازش تنسورها در پردازنده‌های گرافیکی Adreno به‌روزرسانی کرده و فایل‌های اجرایی تازه‌ای برای macOS، iOS و Linux منتشر کرده است.

خبر کوتاهOossa1 دقیقه مطالعه

تیم ggml‑org نسخه b11268 از llama.cpp را منتشر کرد. این به‌روزرسانی باگی را در درایور OpenCL برطرف می‌کند که باعث اختلال در پردازش تنسورها برای کرنل q5_K در پردازنده‌های گرافیکی Adreno می‌شد. فایل‌های اجرایی ازپیش‌ساخته‌شدهٔ تازه‌ای برای Apple Silicon در macOS، رایانه‌های Mac مجهز به پردازنده‌های Intel، iOS و چند پیکربندی Linux، از جمله CPU، Vulkan و CUDA 12.8، ارائه شده است.

چرا مهم است

این اصلاح عملکرد و پایداری اجرای مدل‌های زبانی بزرگ را برای توسعه‌دهندگانی که از دستگاه‌های Android مجهز به پردازنده‌های گرافیکی Adreno استفاده می‌کنند، بهبود می‌دهد.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ggml-org/llama.cpp b11268 ↗llama.cpp۸ مهر ۱۴۰۵<details open> opencl: fix get_tensor for q5_K adreno gemm_nonshuffle kernel (#29555) </details> **Website:** - <https://llama.app> **Attest

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt