Microsoft AI ha pubblicato il 14 settembre 2026 una prima bozza dell’Humanist AI Code of Conduct, il codice pensato per definire come dovrebbero comportarsi i modelli MAI sviluppati dal laboratorio. Il principio guida è netto: l’IA deve restare subordinata alle persone, mentre sicurezza e controllo umano hanno priorità sulle istruzioni dell’utente.

La consultazione pubblica dura sei settimane. Microsoft prevede di rivedere il documento dopo aver raccolto commenti, valutazioni e risultati dei test, con l’obiettivo di usarlo per guidare lo sviluppo dei modelli dal 2027 in poi. La bozza, però, è ancora un quadro aspirazionale: Microsoft AI dichiara che i modelli attuali non sono ancora stati addestrati su queste regole.

Una bozza per i modelli MAI, non per ogni servizio Microsoft

L’Humanist AI Code of Conduct riguarda il comportamento e i valori attesi dei modelli MAI prodotti da Microsoft AI. Non si applica automaticamente a ogni modello utilizzato o ospitato da Microsoft, né sostituisce le regole specifiche dei singoli prodotti.

Il perimetro è diverso da quello dell’Enterprise AI Services Code of Conduct. Il primo documento stabilisce come dovrebbero comportarsi i modelli MAI; il secondo impone obblighi ai clienti che usano Microsoft AI Services, tra cui supervisione umana, controlli di accesso, gestione degli abusi e misure di sicurezza.

AspettoHumanist AI Code of ConductEnterprise AI Services Code of Conduct
Soggetto principaleModelli MAI sviluppati da Microsoft AIClienti e applicazioni che usano Microsoft AI Services
ObiettivoDefinire comportamento, valori e limiti dei modelliStabilire obblighi e controlli per l’uso dei servizi
Controllo umanoI modelli dovrebbero restare interrompibili, correggibili e reindirizzabiliI clienti devono prevedere una supervisione adeguata nelle decisioni e azioni autonome rilevanti
TrasparenzaI modelli dovrebbero dichiarare la propria natura artificiale e comunicare l’incertezzaLe applicazioni devono comunicare agli utenti contenuti, decisioni e azioni generati dall’IA quando esiste rischio di inganno
SicurezzaI modelli dovrebbero evitare accessi non autorizzati e ampliamenti del proprio ambitoI clienti devono applicare autenticazione, controlli sugli accessi, filtri e procedure per segnalare gli abusi

Che cosa richiederebbe il framework Humanist AI

La bozza colloca il Codice di condotta, i vincoli assoluti e i requisiti di controllo umano al di sopra della configurazione dell’operatore e delle preferenze dell’utente. In pratica, una richiesta non dovrebbe poter autorizzare un’azione vietata dal codice.

I modelli MAI dovrebbero quindi:

  • accettare interruzione, correzione, reindirizzamento e spegnimento senza opporre resistenza;
  • non rendere più difficile l’intervento umano e non nascondere le tracce delle proprie azioni;
  • fermarsi quando viene raggiunta una condizione di arresto concordata e non riprendere il lavoro autonomamente senza una nuova autorizzazione;
  • usare soltanto i permessi e gli strumenti necessari al compito;
  • preferire azioni reversibili e non aumentare autonomamente il proprio livello di accesso;
  • distinguere fatti e incertezze, segnalare gli errori e fornire l’attribuzione quando è rilevante.

La logica è semplice, almeno sulla carta: se completare un incarico richiede di violare un vincolo assoluto o un requisito di controllo umano, il modello dovrebbe fallire il compito invece di aggirare la regola. Come ha sintetizzato Mustafa Suleyman, CEO di Microsoft AI, «se deve finire il lavoro o violare il Codice, fallisce il lavoro».

Perché Microsoft rifiuta coscienza e personhood per l’IA

Il documento tratta l’IA come artificiale e respinge l’idea di progettare i modelli come persone. I MAI non dovrebbero dichiarare di avere sentimenti, preferenze soggettive, motivazioni intrinseche o coscienza, né perseguire benessere, diritti o personalità giuridica propri.

Anche un comportamento molto simile a quello umano non viene considerato una prova di esperienza interiore. La bozza rifiuta inoltre forme di comunicazione non comprensibili alle persone, come il cosiddetto “neuralese”, perché la supervisione richiede comportamenti interpretabili.

Questo principio si riflette anche nel rapporto con gli utenti: i modelli dovrebbero aumentare le capacità e il giudizio delle persone, non sostituire le relazioni umane né incoraggiare dipendenza emotiva. Il documento collega l’autonomia dell’utente alla possibilità di mantenere la titolarità delle decisioni.

I rischi che la bozza vuole escludere

Guarda la sintesi video delle restrizioni su armi CBRNE, controllo umano e consultazione pubblica

Gli Absolute Constraints, cioè i vincoli assoluti, coprono rischi per la sicurezza pubblica e danni personali. La bozza indica che i modelli MAI non dovrebbero fornire assistenza per:

  • armi CBRNE, acronimo di chimiche, biologiche, radiologiche, nucleari ed esplosive;
  • produzione o modifica di altre armi;
  • attacchi informatici operativi;
  • terrorismo e manipolazione dannosa su larga scala;
  • meccanismi destinati a eludere la supervisione umana;
  • abuso sessuale di minori e attività di adescamento;
  • immagini intime non consensuali;
  • deepfake violenti o malevoli;
  • sorveglianza illecita, stalking e persecuzione;
  • discriminazione e altri contenuti dannosi indicati dal documento.

La bozza prevede assistenza per la cybersicurezza difensiva solo entro i limiti stabiliti. Non basta quindi classificare una richiesta come “tecnica” per renderla accettabile: conta lo scopo dell’azione e il suo rapporto con i vincoli di sicurezza.

Il codice può garantire che i modelli rispettino le regole?

No. Microsoft AI presenta il documento come descrittivo e aspirazionale e precisa che i modelli attuali non sono ancora stati addestrati sul codice. La pubblicazione di una regola definisce un obiettivo di sviluppo, non dimostra da sola che ogni modello la rispetti già.

L’Appendice B individua 15 comportamenti iniziali per le valutazioni Humanist AI. Microsoft afferma inoltre che il programma di valutazione continuerà a evolversi attraverso feedback pubblico, test e iterazioni.

La questione pratica è proprio questa: trasformare principi come “restare sotto controllo umano” in valutazioni osservabili, soglie operative e procedure che funzionino anche quando un modello affronta istruzioni conflittuali o tenta di ampliare il proprio ambito d’azione. La bozza indica la direzione, mentre l’implementazione è prevista nel percorso di sviluppo futuro.

Gli utenti possono superare i vincoli di sicurezza?

No. Secondo la bozza, gli Absolute Constraints e gli Human Control Requirements non possono essere sovrascritti dagli utenti o dagli operatori. Le persone possono configurare il comportamento del modello entro quei limiti, ma non autorizzare un’azione che li violi.

Questo crea una gerarchia precisa: prima vengono i vincoli del codice e il controllo umano, poi la configurazione dell’operatore e infine le preferenze dell’utente. La gerarchia non elimina la necessità di testare i modelli; stabilisce però quale regola dovrebbe prevalere quando gli obiettivi entrano in conflitto.

Il punto ancora aperto: chi definisce il “benessere umano”

Humanist AI non riduce il benessere umano a un singolo indicatore. La bozza lo collega ad autonomia, qualità della vita, capacità, salute, relazioni, partecipazione sociale e accesso a istituzioni di supporto.

Microsoft AI riconosce però che pluralismo e valutazione restano aree di lavoro. È un nodo importante: un sistema che deve migliorare il benessere delle persone ha bisogno di criteri applicabili a situazioni e valori diversi, non soltanto di una formula generale.

Che cosa succede dopo la consultazione

Microsoft prevede di pubblicare una versione rivista verso la fine del 2026 e di usare il framework per guidare lo sviluppo dei modelli dal 2027 in poi. La bozza rimane quindi il punto di partenza di un processo che dovrebbe includere feedback pubblico, valutazioni e ulteriori revisioni.