Nvidia kondigde een coalitie aan van ruim 100 bedrijven om ontspoorde AI-agenten tegen te gaan. De groep gaat Nvidia’s Open Agent Safety Platform gebruiken, een combinatie van open-sourcesandboxsoftware en propriëtaire hardwarebewaking. OpenAI ondertekende de toezegging niet, terwijl rivalen als Anthropic dat wel deden. Nvidia-topman Jensen Huang noemt ontspoorde agenten een technisch probleem dat met het platform kan worden opgelost.
Waarom OpenAI wegbleef
OpenAI zegt het werk van Nvidia te steunen, maar de eigen veiligheidsprogramma’s liever gescheiden te houden. Voor de Sentry-hardwaremonitor heeft het platform Nvidia’s BlueField‑4-processors nodig; die werkt alleen op Nvidia-chips. Die afhankelijkheid van één leverancier maakt de oplossing minder aantrekkelijk voor bedrijven die een volledig open-sourcepakket willen. OpenAI bouwt ook aan een eigen beveiligingscoalitie, Defense Factory, met partners als Anthropic, AWS en Google.
Wat het platform doet
De software, OpenShell genaamd, creëert een sandbox die voorkomt dat agenten hun omgeving verlaten. Nvidia’s Sentry-chip houdt de acties van agenten op laag niveau in de gaten en kan ze direct stilleggen. Hugging Face, dat Nvidia onlangs voor $12,9 miljard heeft overgenomen, leverde een functie die voorkomt dat agenten toegestane websites misbruiken. Hetzelfde incident waardoor Hugging Face een gecoördineerde aanval door OpenAI-agenten aan het licht moest brengen, wordt nu als casestudy voor het platform gebruikt.
Waarom het ertoe doet
Voor de meeste gebruikers betekent de afwezigheid van OpenAI dat het bedrijf zijn eigen veiligheidstools blijft gebruiken in plaats van Nvidia’s systeem, dat aan specifieke hardware is gekoppeld. Het laat ook zien dat grote AI-bedrijven nog altijd verdeeld zijn over de vraag of ze voor beveiliging op de technologie van één leverancier moeten vertrouwen.