# В TensorRT-LLM 1.3.0rc29 удалили AutoDeploy и добавили поддержку Qwen3.5 FP8

> В релизе удалена функция AutoDeploy и добавлена возможность загружать чекпойнты Qwen3.5 с глобальным масштабированием FP8.

Oossa · 2026-09-29 · https://oossa.com/ru/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA выпустила TensorRT-LLM версии 1.3.0rc29 29 сентября 2026 года. В обновлении удалили интеграцию AutoDeploy — это ломающее обратную совместимость изменение для пользователей, вызывавших её API. Также добавили поддержку чекпойнтов моделей Qwen‑3.5, использующих глобальные масштабы FP8 при загрузке. Кроме того, обновили систему сборки, удалив устаревшую опцию CMake.

## Факты

- Удаление AutoDeploy указано как ломающее обратную совместимость изменение в PR #19028
- Поддержка чекпойнтов Qwen3.5 FP8 добавлена в PR #19519

## Почему это важно

Разработчикам придётся скорректировать код из-за отсутствующих вызовов AutoDeploy, а новые модели Qwen‑3.5 теперь можно запускать с более быстрым форматом FP8.

## Источники и ссылки

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Обновлено: 2026-09-29
