# TensorRT-LLM 1.3.0rc29, AutoDeploy özelliğini kaldırıyor ve Qwen3.5 FP8 desteği ekliyor

> Sürüm, AutoDeploy özelliğini kaldırırken global FP8 ölçeklendirmesi kullanan Qwen3.5 kontrol noktalarının yüklenmesini sağlıyor.

Oossa · 2026-09-29 · https://oossa.com/tr/tensorrt-llm-1-3-0rc29-drops-autodeploy-and-adds-qwen3-5-fp8-support

NVIDIA, TensorRT-LLM’in 1.3.0rc29 sürümünü 29 Eylül 2026’da yayımladı. Güncelleme, API’sini kullananlar için geriye dönük uyumluluğu bozan AutoDeploy entegrasyonunu kaldırıyor ve yükleme sırasında global FP8 ölçekleri kullanan Qwen‑3.5 model kontrol noktalarına destek ekliyor. Değişiklik, eski bir CMake seçeneğinin kaldırılmasıyla derleme sistemini de güncelliyor.

## Gerçekler

- AutoDeploy özelliğinin kaldırılması, PR #19028’de geriye dönük uyumluluğu bozan bir değişiklik olarak listeleniyor
- Qwen3.5 FP8 kontrol noktası desteği PR #19519 ile eklendi

## Neden önemli

Geliştiricilerin, artık bulunmayan AutoDeploy çağrılarını kullanan kodlarını değiştirmesi gerekecek. Yeni Qwen‑3.5 modelleri ise artık daha hızlı FP8 hassasiyetiyle çalıştırılabilecek.

## Kaynaklar ve referanslar

1. [NVIDIA/TensorRT-LLM v1.3.0rc29](https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc29) – TensorRT-LLM, 2026-09-29

Son güncelleme: 2026-09-29
