Il CEO di Microsoft Satya Nadella è l’ultimo esponente di spicco del settore tecnologico a dilungarsi su come migliorare la sicurezza dell’intelligenza artificiale. In un post pubblicato sabato mattina su X, l’amministratore delegato ha sostenuto che è tempo di “fare un passo indietro e valutare l’architettura di fiducia” dell’IA, usando il termine Super Intelligenza, l’espressione preferita dall’amministrazione Trump per indicare l’IA.
Le scatole nere non bastano più
Secondo Nadella, “non si può trattare la Super Intelligenza come un insieme di scatole nere annidate e semplicemente accettare o respingere le sue raccomandazioni, risposte e azioni”. Il ragionamento parte da un presupposto netto: i sistemi di IA non possono essere gestiti come contenitori opachi di cui ci si fida o meno a seconda dell’output. Serve invece una struttura in cui ogni componente sia verificabile e sotto controllo umano diretto, con meccanismi espliciti per intervenire prima che un modello agisca in modo indesiderato.
L’approccio descritto dal manager prevede di “separare il modello dal harness che orchestra il suo lavoro”, oltre a “esternalizzare controlli e salvaguardie”. In pratica, il modello non dovrebbe coincidere con il sistema che lo governa: le funzioni di supervisione vanno tenute fuori, in modo che restino indipendenti dal comportamento della tecnologia che regolano.
Documentazione a prova di manomissione e stop immediato
Nel post, Nadella chiede che “ogni azione significativa del modello vada documentata con evidenza leggibile dall’uomo a prova di manomissione”. Ogni operazione rilevante compiuta da un sistema di IA dovrebbe quindi lasciare una traccia verificabile, che le persone possano consultare senza dipendere dal sistema stesso. A questo si aggiunge la richiesta di sistemi in cui “una persona autorizzata deve sempre poter mettere in pausa o spegnere un modello durante un’attività”: nessuna esecuzione, una volta avviata, dovrebbe risultare irrevocabile.
La proposta più netta riguarda la prevenzione: “Dobbiamo presumere che un modello sia compromesso e contenerlo fin dall’inizio: pensatela come un freno di emergenza”. La metafora richiama i dispositivi di sicurezza delle macchine: il freno non serve quando tutto funziona, ma deve esistere prima che qualcosa vada storto, e va progettato nella struttura stessa del sistema.
Un intervento nel dibattito sulla perdita di controllo
Le dichiarazioni arrivano in un momento delicato: le principali aziende del settore hanno riconosciuto un numero crescente di incidenti in cui sembravano aver perso il controllo dei propri modelli. I casi documentati hanno alimentato la discussione pubblica su quali garanzie siano necessarie prima che sistemi sempre più autonomi vengano diffusi su larga scala.
Il post di Nadella segue anche l’iniziativa del CEO di Anthropic, Dario Amodei, che ha pubblicato un piano per uno sviluppo dell’IA più cauto. Con il suo intervento, il vertice di Microsoft si inserisce così in un confronto tra grandi attori del settore che, dopo anni di corsa alle capacità, sta spostando l’attenzione verso architetture di fiducia, controlli esterni e responsabilità umana.