# TensorRT-LLM 1.3.0rc29 schrapt AutoDeploy en voegt ondersteuning voor Qwen3.5 FP8 toe

> De release verwijdert de functie AutoDeploy en maakt het mogelijk Qwen3.5-checkpoints met globale FP8-schaling te laden.

Oossa · 2026-09-29 · https://oossa.com/nl/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA heeft op 29 september 2026 TensorRT-LLM versie 1.3.0rc29 uitgebracht. De update verwijdert de integratie van AutoDeploy, een ingrijpende wijziging voor gebruikers die de API ervan aanroepen, en voegt ondersteuning toe voor het laden van Qwen-3.5-modelcheckpoints met globale FP8-schaling. Ook is het buildsysteem aangepast: een verouderde CMake-optie is geschrapt.

## De feiten

- De verwijdering van AutoDeploy staat vermeld als een ingrijpende wijziging in PR #19028
- Ondersteuning voor Qwen3.5 FP8-checkpoints is toegevoegd in PR #19519

## Waarom het ertoe doet

Ontwikkelaars moeten hun code aanpassen omdat de AutoDeploy-aanroepen ontbreken. Tegelijkertijd kunnen nieuwe Qwen-3.5-modellen nu met de snellere FP8-precisie draaien.

## Bronnen en referenties

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Laatst bijgewerkt: 2026-09-29
