Breve · 1 min de lectura
TensorRT-LLM 1.3.0rc29 elimina AutoDeploy y añade compatibilidad con Qwen3.5 FP8
La versión elimina la función AutoDeploy y permite cargar checkpoints de Qwen3.5 con escalado FP8 global.
Oossa · Acerca de Oossa
NVIDIA lanzó TensorRT-LLM versión 1.3.0rc29 el 29 de septiembre de 2026. La actualización elimina la integración de AutoDeploy, un cambio incompatible para quienes usaban su API, y añade compatibilidad durante la carga con checkpoints de modelos Qwen-3.5 que utilizan escalas FP8 globales. El cambio también actualiza el sistema de compilación al retirar una opción obsoleta de CMake.
Por qué importa
Los desarrolladores tendrán que adaptar su código debido a la ausencia de las llamadas a AutoDeploy, mientras que ahora podrán ejecutar nuevos modelos Qwen-3.5 con la precisión FP8, más rápida.
Fuentes y referencias
| # | Fuente | Medio | Fecha | Idea clave |
|---|---|---|---|---|
| 1 | NVIDIA/TensorRT-LLM v1.3.0rc29 ↗ | TensorRT-LLM | 29 sept 2026 | ## Highlights - Model Support - Support Qwen3.5 checkpoints with global FP8 scales across model loading paths #19519 - Optimize Gemma4 visio |
1 fuentes
Última actualización:
Oossa · Boletín
La semana en IA, explicada
Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.