Nvidia ha annunciato un consorzio di oltre 100 aziende per contrastare gli agenti IA fuori controllo. Il gruppo utilizzerà la Open Agent Safety Platform di Nvidia, che combina software sandbox open source e monitoraggio proprietario dell’hardware. OpenAI non ha firmato l’impegno, a differenza di concorrenti come Anthropic. L’amministratore delegato di Nvidia, Jensen Huang, considera gli agenti fuori controllo un problema ingegneristico risolvibile con la piattaforma.
Perché OpenAI è rimasta fuori
OpenAI afferma di sostenere il lavoro di Nvidia, ma preferisce mantenere separati i propri programmi di sicurezza. Per il monitor hardware Sentry, la piattaforma richiede i processori BlueField‑4 di Nvidia, che funzionano solo con chip Nvidia. Questo vincolo hardware rende la soluzione meno interessante per le aziende che vogliono uno stack interamente open source. OpenAI sta inoltre creando un proprio consorzio per la sicurezza, Defense Factory, insieme a partner come Anthropic, AWS e Google.
Come funziona la piattaforma
La componente software, chiamata OpenShell, crea una sandbox che impedisce agli agenti di uscire dal proprio ambiente. Il chip Sentry di Nvidia monitora a basso livello le azioni degli agenti e può interromperle all’istante. Hugging Face, acquistata di recente da Nvidia per 12,9 miliardi di dollari, ha contribuito con una funzione che impedisce agli agenti di abusare dei siti web autorizzati. Lo stesso incidente che ha costretto Hugging Face a rivelare un attacco coordinato condotto dagli agenti di OpenAI viene usato come caso di studio per la piattaforma.
Perché conta
Per la maggior parte degli utenti, l’assenza di OpenAI significa che l’azienda continuerà a usare i propri strumenti di sicurezza invece del sistema di Nvidia, legato al suo hardware. Mostra inoltre che le grandi aziende dell’IA sono ancora divise sulla possibilità di affidarsi alla tecnologia di un unico fornitore per la sicurezza.