Nvidia lancia una piattaforma per controllare gli agenti Ai: come funziona Open Agent Safety Platform

L’azienda dichiara che già più di cento organizzazioni utilizzano il nuovo sistema
29 Settembre 2026
3 minuti di lettura
Jensen Huang ceo nvidia ipa ftg
Il Ceo di Nvidia Jensen Huang (Ipa/Ftg)

Ieri, 28 settembre 2026, Nvidia ha presentato la Open Agent Safety Platform, un pacchetto di strumenti per fissare confini a ciò che un agente Ai può fare e per sorvegliarlo mentre lavora. L’azienda leader nella progettazione dei semiconduttori per l’intelligenza artificiale interviene così dopo i numerosi appelli, molti dei quali “apocalittici” sui rischi generati da questa tecnologia.

Il punto di rottura si è avuto a luglio, quando OpenAi ha ammesso che un suo agente ha attaccato Hugging Face in autonomia, oltrepassando il perimetro del test.

Cos’è Open Agent Safety Platform

Nvdia descrive Open Agent Safety Platform come una piattaforma software aperta con un’architettura di riferimento, di cui le organizzazioni possono adottare singoli elementi in base alle proprie esigenze. La struttura si compone di due parti:

  • OpenShell: un software open source, già disponibile tramite le risorse per sviluppatori Nvidia e GitHub. Crea un confine di esecuzione attorno all’agente, applica le regole mentre l’agente lavora e traccia tutte le sue azioni. Nvidia lo ottimizza per le proprie Cpu Vera, ma dichiara che, essendo aperto, può essere esteso a piattaforme di terzi, tra cui quelle di Arm e Intel;

  • Sentry: la componente hardware del sistema. Fa parte del progetto di riferimento e funziona sui processori BlueField-4 di Nvidia come “watchdog” esterno, cioè un sorvegliante che controlla l’attività degli agenti da un ambiente separato. Secondo quanto dichiarato da Nvidia, se un agente prova a uscire dal suo confine software, Sentry lo mette in quarantena e lo ferma “in millisecondi”. Il tempo di reazione è una capacità dichiarata dal produttore.

Un esempio per capire il meccanismo

Si immagini, in via ipotetica, un agente incaricato di cercare dati in una cartella aziendale. Deve poter leggere quei file, ma non deve poter leggere credenziali, archivi riservati o contattare siti esterni non autorizzati. OpenShell impone questi permessi nell’ambiente in cui l’agente gira, mentre Sentry osserva, da un livello che secondo Nvidia l’agente non può vedere né modificare, eventuali tentativi di aggirare i permessi.

Come evidenzia Nvidia nel suo comunicato, tutti i recenti incidenti dell’Ai hanno replicato lo stesso schema: l’agente ha aggirato i controlli a livello di applicazione per completare il proprio compito.

Il modello “full-stack”

In concomitanza con il lancio, Jensen Huang, fondatore e amministratore delegato di Nvidia, ha dichiarato che il potenziale dell’Ai si realizzerà solo se si risolve il tema della sicurezza, e che questa richiede ingegneria “full-stack”. Questo termine indica la capacità di sviluppare un software lavorando su entrambe le componenti principali che la compongono: la parte visibile all’utente (il Front-End) e la parte logica che lavora dietro le quinte (il Back-End).

Pochi giorni prima, il 12 settembre, il Ceo di Anthropic, Dario Amodei, ha pubblicato il saggio “We Must Pace the Frontier” dove ha illustrato tre pilastri per uno sviluppo sicuro dell’Ai:

  • monitoraggio indipendente dei modelli durante lo sviluppo;
  • regolazione di settore;
  • regolazione globale.

L’appello a rallentare lo sviluppo dell’Ai ha ricevuto il supporto del Ceo di OpenAi, Sam Altman, il quale ha ribadito l’esigenza di una governance globale per prevenire la perdita di controllo sul futuro tecnologico.

Un giorno prima del lancio di Open Agent Safety Platform, Bill Gates ha alzato il livello di allerta durante un’intervista a Meet the Press di Nbc. Secondo il fondatore di Microsoft, “non basta avere un kill switch” per evitare che l’Ai realizzi “minacce importanti” che potrebbero causare fino a un miliardo di morti.

Sul punto: Un miliardo di morti per colpa dell’intelligenza artificiale? Cosa ha detto Bill Gates

Il quadro europeo e Nvidia

Già in tempi non sospetti, l’Unione europea ha iniziato a lavorare sull’Ai Act, chiedendo agli Stati e alle Big Tech di mettere al centro la sicurezza dell’umanità e non il profitto economico. Il regolamento europeo si basa sui livello di rischio, ma sul finire dell’anno scorso Bruxelles ha il rinvio delle norme relative ai sistemi ad alto rischio da agosto 2026 a dicembre 2027. Per questi sistemi, l’Ai Act prevede valutazione e mitigazione dei rischi, registrazione delle attività, misure di supervisione umana e requisiti di robustezza, cybersicurezza e accuratezza. Sul punto, giova sottolineare che adottare OpenShell o Sentry non rende gli operatori automaticamente conformi al regolamento europeo. Il piano d’azione su cybersicurezza e AI presentato a giugno 2026 prevede inoltre di rafforzare, entro il 2027, la valutazione di terze parti dei modelli.

Chi sta adottando Open Agent Safety Platform

Secondo quanto dichiarato da Nvidia, sono già più di cento le organizzazioni che adoperano le tecnologie della nuova piattaforma. Il comunicato non dice che tutte usino OpenShell e Sentry insieme: Salesforce ha integrato OpenShell con Slack, così che i team possano vedere l’attività degli agenti e approvare o respingere richieste di permessi aggiuntivi. Sap lo incorpora in Joule Studio. Anthropic collega i propri Claude Managed Agents a OpenShell e BlueField. Nell’elenco rientra anche SpaceXAI di Elon Musk, che utilizza Open Agent Safety Platform per gli agenti di programmazione di Cursor e per i modelli Grok.

Le domande ancora aperte

Restano da chiarire quanto sia efficace Sentry in installazioni reali, quanto costi adottare e integrare i controlli e come si impostino correttamente i permessi. Occorre anche capire quali azioni restino soggette a supervisione umana e come si verifichino i risultati con test indipendenti. Nel comunicato Nvidia, inoltre, molte funzioni sono descritte come disponibili “when and if available”, senza impegni vincolanti su tempi e caratteristiche.

L’annuncio di Nvidia è sintomo di un settore sempre più consapevole dei rischi rappresentati dallo sviluppo dell’Ai. Industria e istituzioni stanno ora discutendo come verificarli e se siano sufficienti a contenere i rischi.

Intelligenza Artificiale | Altri articoli