短信 · 1 分で読める
TensorRT-LLM 1.3.0rc29、AutoDeployを削除しQwen3.5のFP8に対応
今回のリリースではAutoDeploy機能が削除され、グローバルFP8スケーリングを使うQwen3.5のチェックポイントを読み込めるようになった。
Oossa · Oossaについて
NVIDIAは2026年9月29日、TensorRT-LLMバージョン1.3.0rc29をリリースした。今回のアップデートでは、APIを呼び出していたユーザーに影響する破壊的変更として、AutoDeployとの統合が削除された。また、読み込み時にグローバルFP8スケールを使うQwen-3.5モデルのチェックポイントに対応した。さらに、古いCMakeオプションを廃止し、ビルドシステムも更新している。
なぜ重要か
開発者はAutoDeployの呼び出しが使えなくなるためコードの修正が必要になる一方、新しいQwen-3.5モデルをより高速なFP8精度で実行できるようになる。
この記事は役に立ちましたか?
出典と参考資料
| # | 出典 | 媒体 | 日付 | 要点 |
|---|---|---|---|---|
| 1 | NVIDIA/TensorRT-LLM v1.3.0rc29 ↗ | TensorRT-LLM | 2026/09/29 | ## Highlights - Model Support - Support Qwen3.5 checkpoints with global FP8 scales across model loading paths #19519 - Optimize Gemma4 visio |
1 件の出典
最終更新:
Oossa · ニュースレター
今週のAIを、わかりやすく
毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。