# NVIDIA lanza Nemotron 3 Nano Omni, un modelo multimodal abierto de 30B

> El modelo de 30.000 millones de parámetros ya procesa texto e imágenes; más adelante incorporará compatibilidad con video y audio.

Oossa · 2026-10-06 · https://oossa.com/es/nvidia-releases-open-nemotron-3-nano-omni-30b-multimodal-model

NVIDIA ha publicado un nuevo modelo de IA de código abierto llamado Nemotron 3 Nano Omni. Tiene 30.000 millones de parámetros en total, pero solo 3.000 millones están activos en cada momento gracias a su arquitectura Mixture-of-Experts. Actualmente, el modelo puede razonar a partir de texto e imágenes. Para procesar entradas de video o audio, hay que desactivar el modo de razonamiento con una opción especial.

## Qué puede hacer el modelo

El modelo es multimodal, es decir, puede procesar más de un tipo de datos. En su lanzamiento admite tareas de texto a texto y de texto a imagen, como responder preguntas sobre una foto o describir una imagen. NVIDIA señala que técnicamente es posible introducir video y audio, pero para evitar errores hay que incluir `enable_thinking: false` en la solicitud.

## Por qué importa

Para desarrolladores e investigadores, Nemotron 3 Nano Omni ofrece un modelo de gran escala disponible de forma gratuita, que se puede ajustar para aplicaciones que necesitan comprender tanto el lenguaje como las imágenes. Como solo se activa una parte de sus 30.000 millones de parámetros, funciona más rápido y cuesta menos que un modelo completo de 30.000 millones, lo que podría reducir el costo de crear productos multimodales.

## Los hechos

- El modelo tiene 30.000 millones de parámetros en total y 3.000 millones activos.
- Utiliza una arquitectura híbrida Mixture-of-Experts.
- En su lanzamiento, admite razonamiento con entradas de texto e imágenes.
- Las solicitudes con video y audio requieren la opción `enable_thinking: false`.
- NVIDIA publica el modelo como software de código abierto.

## Por qué importa

Los desarrolladores ya pueden experimentar con un modelo multimodal de gran escala sin pagar por una API comercial. El diseño con expertos activos reduce los costos de computación y hace más viable que equipos pequeños creen aplicaciones capaces de entender tanto palabras como imágenes.

## Fuentes y referencias

1. [NVIDIA Nemotron 3 Nano Omni 30B A3B](https://fireworks.ai/models/fireworks/nvidia-nemotron-3-nano-omni-30b-a3b) – Fireworks AI

Última actualización: 2026-10-06
