Oossa

‏vLLM 0.31.0 يضيف تخزينًا مؤقتًا للأوزان لتسريع إعادة التشغيل

تقدّم مكتبة vLLM مفتوحة المصدر لتشغيل النماذج اللغوية الكبيرة في الإصدار 0.31.0 أداةً للتحميل المسبق تُبقي الأوزان بعد التكميم في ذاكرة GPU عند إعادة تشغيل المحرك.

خبر موجزبقلم نشرته Oossa: 1 دقائق قراءة

أصدر مشروع vLLM الإصدار 0.31.0 في 5 أكتوبر 2026. وأبرز ما يقدّمه أمر جديد للتحميل المسبق يشغّل خدمةً لتخزين الأوزان مؤقتًا، ما يتيح بقاء أوزان النماذج بعد التكميم في ذاكرة GPU عند إعادة تشغيل الخادم. وتدعم الميزة التوازي في البيانات، كما تضيف نقطة نهاية لفحص الحالة الصحية. ويضم الإصدار أيضًا 717 مساهمة برمجية من 307 مساهمين.

لماذا يهم

يمكن للمطوّرين تحديث خدمات النماذج اللغوية الكبيرة أو إعادة تشغيلها من دون تحميل النماذج الضخمة من جديد، ما يقلل وقت التوقف للتطبيقات التي تعتمد على vLLM.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.