# TensorRT-LLM 1.3.0rc29、AutoDeployを削除しQwen3.5のFP8に対応

> 今回のリリースではAutoDeploy機能が削除され、グローバルFP8スケーリングを使うQwen3.5のチェックポイントを読み込めるようになった。

Oossa · 2026-09-29 · https://oossa.com/ja/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIAは2026年9月29日、TensorRT-LLMバージョン1.3.0rc29をリリースした。今回のアップデートでは、APIを呼び出していたユーザーに影響する破壊的変更として、AutoDeployとの統合が削除された。また、読み込み時にグローバルFP8スケールを使うQwen-3.5モデルのチェックポイントに対応した。さらに、古いCMakeオプションを廃止し、ビルドシステムも更新している。

## 事実

- AutoDeployの削除はPR #19028で破壊的変更として記載されている
- Qwen3.5のFP8チェックポイント対応はPR #19519で追加された

## なぜ重要か

開発者はAutoDeployの呼び出しが使えなくなるためコードの修正が必要になる一方、新しいQwen-3.5モデルをより高速なFP8精度で実行できるようになる。

## 出典と参考資料

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

最終更新: 2026-09-29
