OossaAIは急速に進化しています。私たちがわかりやすく解説します。
ニュースレター

短信 · 1 分で読める

TensorRT-LLM 1.3.0rc29、AutoDeployを削除しQwen3.5のFP8に対応

今回のリリースではAutoDeploy機能が削除され、グローバルFP8スケーリングを使うQwen3.5のチェックポイントを読み込めるようになった。

Oossa · Oossaについて

NVIDIAは2026年9月29日、TensorRT-LLMバージョン1.3.0rc29をリリースした。今回のアップデートでは、APIを呼び出していたユーザーに影響する破壊的変更として、AutoDeployとの統合が削除された。また、読み込み時にグローバルFP8スケールを使うQwen-3.5モデルのチェックポイントに対応した。さらに、古いCMakeオプションを廃止し、ビルドシステムも更新している。

なぜ重要か

開発者はAutoDeployの呼び出しが使えなくなるためコードの修正が必要になる一方、新しいQwen-3.5モデルをより高速なFP8精度で実行できるようになる。

この記事は役に立ちましたか?

出典と参考資料

#出典媒体日付要点
1NVIDIA/TensorRT-LLM v1.3.0rc29 ↗TensorRT-LLM2026/09/29## Highlights - Model Support - Support Qwen3.5 checkpoints with global FP8 scales across model loading paths #19519 - Optimize Gemma4 visio

1 件の出典

最終更新:

Oossallms.txt.md

共有

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。