# TensorRT-LLM 1.3.0rc29 remove o AutoDeploy e adiciona suporte a FP8 para o Qwen3.5

> A versão remove o recurso AutoDeploy e permite carregar checkpoints do Qwen3.5 com escalonamento FP8 global.

Oossa · 2026-09-29 · https://oossa.com/pt/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

A NVIDIA lançou a versão 1.3.0rc29 do TensorRT-LLM em 29 de setembro de 2026. A atualização remove a integração com o AutoDeploy, uma mudança incompatível para quem utilizava a API do recurso, e adiciona suporte ao carregamento de checkpoints do modelo Qwen‑3.5 que usam escalas FP8 globais. A mudança também atualiza o sistema de compilação, eliminando uma opção obsoleta do CMake.

## Os fatos

- A remoção do AutoDeploy é descrita como uma mudança incompatível na PR #19028
- O suporte a checkpoints FP8 do Qwen3.5 foi adicionado na PR #19519

## Por que importa

Os desenvolvedores terão de adaptar o código que usa as chamadas do AutoDeploy, enquanto os novos modelos Qwen‑3.5 poderão ser executados com a precisão FP8, mais rápida.

## Fontes e referências

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Última atualização: 2026-09-29
