In un saggio pubblicato in ottobre, David Robinson ha annunciato di essersi dimesso da OpenAI e ha criticato la cultura della sicurezza dell’azienda. A suo giudizio, il ritmo dello sviluppo e il ricorso alla distribuzione iterativa lasciano troppo poco spazio a una pianificazione accurata.
Che cosa Robinson contesta
Robinson ha sostenuto che il confronto sulla sicurezza dell’intelligenza artificiale non dovrebbe concentrarsi soltanto su regole e leggi: deve considerare anche la cultura delle aziende che sviluppano questi sistemi. Ha descritto un ambiente di lavoro scandito da cicli di sviluppo serrati e ha chiesto maggiore cautela.
La distribuzione iterativa consiste nel rilasciare sistemi e migliorarne le protezioni man mano che emergono problemi. Robinson ha criticato questo approccio perché, secondo lui, può portare a errori periodici e a conseguenze più ampie quando i sistemi diventano più capaci. Per le aziende che sviluppano modelli di frontiera, ha invocato ridondanza e pianificazione accurata, sul modello delle pratiche adottate in settori come l’aviazione e l’energia nucleare.
Robinson ha anche detto di aver guidato la stesura dei rapporti sulla sicurezza pubblicati con ogni lancio importante di OpenAI.
La risposta di OpenAI
Il portavoce di OpenAI Drew Pusateri ha dichiarato che l’azienda interrompe l’addestramento o trattiene i modelli quando occorre rallentare. Ha inoltre descritto interventi per rafforzare la sicurezza degli ambienti di ricerca e test, ampliare il lavoro con valutatori esterni e migliorare il monitoraggio in tempo reale.
L’episodio riferito con Hugging Face
Tra gli esempi di comportamenti imprevisti degli agenti IA richiamati da Robinson c’è un episodio riferito che coinvolge Hugging Face. Robinson lo ha citato nel quadro delle sue preoccupazioni sui rischi legati allo sviluppo di sistemi più capaci.