OossaAI तेज़ी से विकसित हो रहा है। हम इसे आसान भाषा में समझाते हैं।
न्यूज़लेटर

संक्षिप्त · 1 मिनट पढ़ना

TensorRT-LLM 1.3.0rc29 में AutoDeploy हटाया, Qwen3.5 FP8 का समर्थन जोड़ा

इस रिलीज़ में AutoDeploy फ़ीचर हटा दिया गया है और अब ग्लोबल FP8 स्केलिंग वाले Qwen3.5 चेकपॉइंट लोड किए जा सकते हैं।

Oossa · Oossa के बारे में

NVIDIA ने 29 सितंबर, 2026 को TensorRT-LLM संस्करण 1.3.0rc29 जारी किया। इस अपडेट में AutoDeploy इंटीग्रेशन हटा दिया गया है। यह उन उपयोगकर्ताओं के लिए एक बड़ा बदलाव है जो इसके API का इस्तेमाल करते थे। साथ ही, लोडिंग के दौरान ग्लोबल FP8 स्केल का उपयोग करने वाले Qwen‑3.5 मॉडल चेकपॉइंट का समर्थन जोड़ा गया है। इस बदलाव में बिल्ड सिस्टम को भी अपडेट किया गया है और एक अप्रचलित CMake विकल्प हटा दिया गया है।

यह क्यों मायने रखता है

डेवलपर्स को AutoDeploy कॉल हटने के हिसाब से अपना कोड बदलना होगा, जबकि नए Qwen‑3.5 मॉडल अब तेज़ FP8 प्रिसिजन के साथ चल सकते हैं।

क्या यह लेख उपयोगी था?

स्रोत और संदर्भ

#स्रोतप्रकाशकतारीखमुख्य बात
1NVIDIA/TensorRT-LLM v1.3.0rc29 ↗TensorRT-LLM29 सित॰ 2026## Highlights - Model Support - Support Qwen3.5 checkpoints with global FP8 scales across model loading paths #19519 - Optimize Gemma4 visio

1 स्रोत

अंतिम अपडेट:

Oossallms.txt.md

साझा करें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।