Oossa

llama.cpp v0.1.11534 يحسّن عمليات النسخ عبر CUDA

تزيل مكتبة LLaMA مفتوحة المصدر للاستدلال عمليات نقل غير ضرورية للذاكرة على GPU، ما يقلل العبء في بعض الاستخدامات.

خبر موجزبقلم نشرته Oossa: 1 دقائق قراءة

أصدر فريق ggml‑org الإصدار b11534 من llama.cpp في 2026-10-09. يدمج التحديث عمليات نسخ لقطات الحالة في الذاكرة المؤقتة المتكررة، ويلغي عمليات نسخ إضافية عبر CUDA عندما تكون K = 1، وهي حالة فك ترميز غير استدلالي تكهني. يقتصر التغيير على الواجهة الخلفية لـ CUDA، لذا لا تتغير إصدارات CPU وVulkan. تتوفر للتنزيل ملفات ثنائية مُعدّة مسبقًا لأنظمة macOS وiOS وعدة إصدارات من Ubuntu.

ينبغي أن يلاحظ مستخدمو إصدار CUDA انخفاضًا طفيفًا في حركة بيانات ذاكرة GPU، ما قد يحسّن السرعة على الأجهزة المدعومة.

لماذا يهم

قد يحصل مستخدمو CUDA على استدلال أسرع لأن المكتبة تنقل بيانات أقل على GPU.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.