# TensorRT-LLM 1.3.0rc29 streicht AutoDeploy und ergänzt FP8-Unterstützung für Qwen3.5

> Das Release entfernt die AutoDeploy-Funktion und ermöglicht das Laden von Qwen3.5-Checkpoints mit globaler FP8-Skalierung.

Oossa · 2026-09-29 · https://oossa.com/de/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA hat TensorRT-LLM Version 1.3.0rc29 am 29. September 2026 veröffentlicht. Das Update entfernt die AutoDeploy-Integration – eine inkompatible Änderung für Nutzer, die deren API aufgerufen haben – und ergänzt die Unterstützung für Qwen-3.5-Modell-Checkpoints, die beim Laden globale FP8-Skalierungsfaktoren verwenden. Außerdem wurde das Build-System aktualisiert und eine veraltete CMake-Option entfernt.

## Die Fakten

- Die Entfernung von AutoDeploy ist in PR #19028 als inkompatible Änderung aufgeführt
- Die Unterstützung für Qwen3.5-FP8-Checkpoints wurde mit PR #19519 ergänzt

## Warum es wichtig ist

Entwickler müssen ihren Code anpassen, weil die AutoDeploy-Aufrufe wegfallen. Neue Qwen-3.5-Modelle lassen sich nun mit der schnelleren FP8-Präzision ausführen.

## Quellen und Referenzen

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Zuletzt aktualisiert: 2026-09-29
