# NVIDIA lancia Nemotron 3 Nano Omni, modello multimodale aperto da 30B

> Il modello da 30 miliardi di parametri gestisce già testi e immagini; il supporto a video e audio è previsto.

Oossa · 2026-10-06 · https://oossa.com/it/nvidia-releases-open-nemotron-3-nano-omni-30b-multimodal-model

NVIDIA ha pubblicato un nuovo modello di IA open source, chiamato Nemotron 3 Nano Omni. Ha 30 miliardi di parametri complessivi, ma ne attiva solo 3 miliardi alla volta grazie all’architettura Mixture-of-Experts. Al momento il modello può ragionare su testi e immagini. Per elaborare video o audio bisogna disattivare la modalità di ragionamento con un flag specifico.

## Cosa può fare il modello

Il modello è multimodale, cioè può elaborare più tipi di dati. Al lancio supporta attività da testo a testo e da testo a immagine, per esempio rispondere a domande su una foto o descrivere un’immagine. NVIDIA precisa che è tecnicamente possibile inserire video e audio, ma per evitare errori occorre impostare `enable_thinking: false` nella richiesta.

## Perché è importante

Per sviluppatori e ricercatori, Nemotron 3 Nano Omni offre un modello di grandi dimensioni disponibile gratuitamente, che può essere ottimizzato per applicazioni che richiedono capacità linguistiche e di comprensione visiva. Poiché è attiva solo una parte dei 30 miliardi di parametri, il modello è più veloce ed economico di un modello completo da 30 miliardi, e potrebbe ridurre i costi di sviluppo di prodotti multimodali.

## I fatti

- Il modello contiene 30 miliardi di parametri complessivi, di cui 3 miliardi attivi.
- Utilizza un’architettura ibrida Mixture-of-Experts.
- Al lancio supporta il ragionamento su testi e immagini.
- Per le richieste con video e audio è necessario il flag `enable_thinking: false`.
- NVIDIA ha rilasciato il modello come open source.

## Perché conta

Gli sviluppatori possono ora sperimentare con un modello multimodale di grandi dimensioni senza pagare per un’API commerciale. L’architettura con esperti attivi riduce i costi di calcolo e rende più fattibile per i team più piccoli creare applicazioni capaci di comprendere sia parole sia immagini.

## Fonti e riferimenti

1. [NVIDIA Nemotron 3 Nano Omni 30B A3B](https://fireworks.ai/models/fireworks/nvidia-nemotron-3-nano-omni-30b-a3b) – Fireworks AI

Ultimo aggiornamento: 2026-10-06
