# TensorRT-LLM 1.3.0rc29 में AutoDeploy हटाया, Qwen3.5 FP8 का समर्थन जोड़ा

> इस रिलीज़ में AutoDeploy फ़ीचर हटा दिया गया है और अब ग्लोबल FP8 स्केलिंग वाले Qwen3.5 चेकपॉइंट लोड किए जा सकते हैं।

Oossa · 2026-09-29 · https://oossa.com/hi/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA ने 29 सितंबर, 2026 को TensorRT-LLM संस्करण 1.3.0rc29 जारी किया। इस अपडेट में AutoDeploy इंटीग्रेशन हटा दिया गया है। यह उन उपयोगकर्ताओं के लिए एक बड़ा बदलाव है जो इसके API का इस्तेमाल करते थे। साथ ही, लोडिंग के दौरान ग्लोबल FP8 स्केल का उपयोग करने वाले Qwen‑3.5 मॉडल चेकपॉइंट का समर्थन जोड़ा गया है। इस बदलाव में बिल्ड सिस्टम को भी अपडेट किया गया है और एक अप्रचलित CMake विकल्प हटा दिया गया है।

## तथ्य

- PR #19028 में AutoDeploy को हटाने को एक बड़ा बदलाव बताया गया है
- PR #19519 में Qwen3.5 FP8 चेकपॉइंट का समर्थन जोड़ा गया है

## यह क्यों मायने रखता है

डेवलपर्स को AutoDeploy कॉल हटने के हिसाब से अपना कोड बदलना होगा, जबकि नए Qwen‑3.5 मॉडल अब तेज़ FP8 प्रिसिजन के साथ चल सकते हैं।

## स्रोत और संदर्भ

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

अंतिम अपडेट: 2026-09-29
