# TensorRT-LLM 1.3.0rc29 rimuove AutoDeploy e aggiunge il supporto FP8 per Qwen3.5

> La release elimina la funzionalità AutoDeploy e consente di caricare checkpoint Qwen3.5 con scaling FP8 globale.

Oossa · 2026-09-29 · https://oossa.com/it/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA ha rilasciato TensorRT-LLM versione 1.3.0rc29 il 29 settembre 2026. L’aggiornamento elimina l’integrazione AutoDeploy, una modifica incompatibile con le versioni precedenti per chi ne utilizzava l’API, e aggiunge il supporto al caricamento di checkpoint dei modelli Qwen‑3.5 che usano scale FP8 globali. La modifica aggiorna anche il sistema di build rimuovendo un’opzione CMake obsoleta.

## I fatti

- La rimozione di AutoDeploy è indicata come modifica incompatibile con le versioni precedenti nella PR #19028
- Il supporto per i checkpoint Qwen3.5 FP8 è stato aggiunto nella PR #19519

## Perché conta

Gli sviluppatori dovranno modificare il codice che richiama AutoDeploy, mentre i nuovi modelli Qwen‑3.5 potranno ora funzionare con la precisione FP8, più veloce.

## Fonti e riferimenti

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Ultimo aggiornamento: 2026-09-29
