Oossaالذكاء الاصطناعي يتطور بسرعة. نحن نشرحه ببساطة.
النشرة البريدية

خبر موجز · 1 دقائق قراءة

TensorRT-LLM 1.3.0rc29 يستغني عن AutoDeploy ويدعم Qwen3.5 بصيغة FP8

يزيل الإصدار ميزة AutoDeploy، ويتيح تحميل نقاط التحقق لنموذج Qwen3.5 باستخدام التحجيم العام بصيغة FP8.

Oossa · عن Oossa

أصدرت NVIDIA الإصدار 1.3.0rc29 من TensorRT-LLM في 29 سبتمبر 2026. ويحذف التحديث تكامل AutoDeploy، في تغيير غير متوافق مع الإصدارات السابقة للمستخدمين الذين يستدعون واجهته البرمجية، كما يضيف دعم نقاط التحقق لنموذج Qwen‑3.5 التي تستخدم مقاييس FP8 عامة أثناء التحميل. ويحدّث التغيير أيضًا نظام البناء عبر إزالة خيار CMake قديم.

لماذا يهم

سيحتاج المطورون إلى تعديل شيفراتهم بسبب غياب استدعاءات AutoDeploy، فيما بات بإمكانهم تشغيل نماذج Qwen‑3.5 الجديدة بدقة FP8 الأسرع.

هل كان هذا المقال مفيدًا؟

المصادر والمراجع

#المصدرالجهة الناشرةالتاريخالخلاصة
1NVIDIA/TensorRT-LLM v1.3.0rc29 ↗TensorRT-LLM29‏/09‏/2026## Highlights - Model Support - Support Qwen3.5 checkpoints with global FP8 scales across model loading paths #19519 - Optimize Gemma4 visio

1 مصادر

آخر تحديث:

Oossallms.txt.md

مشاركة

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.