# TensorRT-LLM 1.3.0rc29 elimina AutoDeploy y añade compatibilidad con Qwen3.5 FP8

> La versión elimina la función AutoDeploy y permite cargar checkpoints de Qwen3.5 con escalado FP8 global.

Oossa · 2026-09-29 · https://oossa.com/es/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA lanzó TensorRT-LLM versión 1.3.0rc29 el 29 de septiembre de 2026. La actualización elimina la integración de AutoDeploy, un cambio incompatible para quienes usaban su API, y añade compatibilidad durante la carga con checkpoints de modelos Qwen-3.5 que utilizan escalas FP8 globales. El cambio también actualiza el sistema de compilación al retirar una opción obsoleta de CMake.

## Los hechos

- La eliminación de AutoDeploy figura como un cambio incompatible en la PR #19028
- La compatibilidad con checkpoints FP8 de Qwen3.5 se añadió en la PR #19519

## Por qué importa

Los desarrolladores tendrán que adaptar su código debido a la ausencia de las llamadas a AutoDeploy, mientras que ahora podrán ejecutar nuevos modelos Qwen-3.5 con la precisión FP8, más rápida.

## Fuentes y referencias

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Última actualización: 2026-09-29
