Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

انتشار llama.cpp b11270 با بهینه‌سازی GPU و باینری‌های تازه

کتابخانه متن‌باز llama.cpp نسخه b11270 را با بهینه‌سازی تفریق در GPU و باینری‌های آماده برای macOS، iOS و Ubuntu منتشر کرد.

خبر کوتاهOossa1 دقیقه مطالعه

تیم ggml‑org در ۳۰ سپتامبر ۲۰۲۶ نسخه b11270 از llama.cpp را منتشر کرد. در این نسخه، یکی از عملیات‌های GPU در پلتفرم HIP شرکت AMD بهینه شده و دستور تفریق بایتیِ کندتر با دستوری سریع‌تر جایگزین شده است. این انتشار همچنین بسته‌های باینری تازه‌ای برای macOS (Apple Silicon و Intel)، iOS و چند نسخه Ubuntu، از جمله نسخه‌های GPU مجهز به Vulkan، ارائه می‌کند.

چرا مهم است

این بهینه‌سازی GPU می‌تواند اجرای مدل‌ها را روی سخت‌افزار AMD سریع‌تر کند و باینری‌های آماده هم کار توسعه‌دهندگان را برای آزمایش llama.cpp روی پلتفرم‌های بیشتری آسان‌تر می‌کنند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ggml-org/llama.cpp b11270 ↗llama.cpp۸ مهر ۱۴۰۵<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt