# TensorRT-LLM 1.3.0rc29 tar bort AutoDeploy och lägger till stöd för Qwen3.5 med FP8

> Versionen tar bort funktionen AutoDeploy och gör det möjligt att läsa in Qwen3.5-checkpoints med global FP8-skalning.

Oossa · 2026-09-29 · https://oossa.com/sv/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA släppte TensorRT-LLM version 1.3.0rc29 den 29 september 2026. Uppdateringen tar bort AutoDeploy-integrationen, en ändring som bryter bakåtkompatibiliteten för användare som anropat dess API, och lägger till stöd för Qwen‑3.5-modellcheckpoints som använder globala FP8-skalor vid inläsning. Ändringen uppdaterar också byggsystemet genom att ta bort ett föråldrat CMake-alternativ.

## Fakta

- Borttagningen av AutoDeploy anges som en inkompatibel ändring i PR #19028
- Stöd för Qwen3.5-checkpoints med FP8 har lagts till i PR #19519

## Varför det spelar roll

Utvecklare behöver anpassa sin kod eftersom anropen till AutoDeploy inte längre finns, samtidigt som nya Qwen‑3.5-modeller nu kan köras med den snabbare FP8-precisionen.

## Källor och referenser

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Senast uppdaterad: 2026-09-29
