# TensorRT-LLM 1.3.0rc29 قابلیت AutoDeploy را حذف و پشتیبانی از FP8 در Qwen3.5 را اضافه می‌کند

> در این نسخه، قابلیت AutoDeploy حذف شده و امکان بارگذاری چک‌پوینت‌های Qwen3.5 با مقیاس‌دهی سراسری FP8 فراهم شده است.

Oossa · 2026-09-29 · https://oossa.com/fa/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA نسخه 1.3.0rc29 از TensorRT-LLM را در ۲۹ سپتامبر ۲۰۲۶ منتشر کرد. این به‌روزرسانی یکپارچه‌سازی AutoDeploy را حذف می‌کند؛ تغییری ناسازگار که بر کاربرانی که API آن را فراخوانی می‌کردند اثر می‌گذارد. همچنین پشتیبانی از بارگذاری چک‌پوینت‌های مدل Qwen‑3.5 با مقیاس‌های سراسری FP8 را اضافه می‌کند. این تغییر، سیستم ساخت را هم به‌روزرسانی کرده و یک گزینه منسوخ‌شده CMake را کنار می‌گذارد.

## حقایق

- حذف AutoDeploy در PR #19028 به‌عنوان تغییری ناسازگار ثبت شده است
- پشتیبانی از چک‌پوینت‌های FP8 در Qwen3.5 در PR #19519 اضافه شده است

## چرا مهم است

توسعه‌دهندگان باید کد خود را با حذف فراخوانی‌های AutoDeploy سازگار کنند؛ در عین حال، مدل‌های جدید Qwen‑3.5 اکنون می‌توانند با دقت FP8 سریع‌تر اجرا شوند.

## منابع و ارجاع‌ها

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

آخرین به‌روزرسانی: 2026-09-29
