# TensorRT-LLM 1.3.0rc29 supprime AutoDeploy et prend en charge Qwen3.5 en FP8

> Cette version supprime la fonctionnalité AutoDeploy et permet de charger des checkpoints Qwen3.5 avec une mise à l’échelle FP8 globale.

Oossa · 2026-09-29 · https://oossa.com/fr/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA a publié TensorRT-LLM version 1.3.0rc29 le 29 septembre 2026. La mise à jour supprime l’intégration AutoDeploy, une rupture de compatibilité pour les utilisateurs qui faisaient appel à son API, et ajoute la prise en charge, au chargement, des checkpoints de modèles Qwen‑3.5 utilisant des facteurs d’échelle FP8 globaux. Elle met également à jour le système de compilation en supprimant une option CMake obsolète.

## Les faits

- La suppression d’AutoDeploy est répertoriée comme une rupture de compatibilité dans la PR #19028
- La prise en charge des checkpoints Qwen3.5 FP8 a été ajoutée dans la PR #19519

## Pourquoi c'est important

Les développeurs devront adapter leur code aux appels AutoDeploy qui ne sont plus disponibles, tandis que les nouveaux modèles Qwen‑3.5 pourront désormais fonctionner avec la précision FP8, plus rapide.

## Sources et références

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Dernière mise à jour: 2026-09-29
