Oossa

پیش‌نسخه b11517 از llama.cpp گزینه دقت CUDA را اضافه کرد

کتابخانه متن‌باز استنتاج LLaMA در 9 اکتبر 2026 نسخه b11517 را منتشر کرد و گزینه‌ای برای تعیین دقت source-1 در CUDA افزود.

خبر کوتاهنویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

پروژه llama.cpp در 9 اکتبر 2026 پیش‌نسخه‌ای تازه با نام b11517 منتشر کرد. این به‌روزرسانی گزینه‌ای برای CUDA اضافه می‌کند که به کاربران امکان می‌دهد دقت source-1 را به دستیارهای MMQ، بخشی سطح‌پایین از کد GPU، منتقل کنند. این تغییر با امضای یکی از مشارکت‌کنندگان NVIDIA منتشر شده و شامل نسخه‌های CUDA 12 و 13 برای Linux و Windows می‌شود. این انتشار همچنین اهداف ساخت را برای پلتفرم‌های متعدد دیگری، از macOS با Apple Silicon تا Android با Snapdragon، در بر می‌گیرد.

این به‌روزرسانی از صفحه GitHub پروژه و وب‌سایت llama.app در دسترس است.

چرا مهم است

توسعه‌دهندگان اکنون می‌توانند دقت GPU را در llama.cpp کنترل کنند؛ قابلیتی که ممکن است کارایی یا میزان استفاده از حافظه را هنگام اجرای مدل‌های LLaMA بهبود دهد.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.