OpenAI ha licenziato tre dipendenti dopo un’indagine interna sulla gestione di informazioni sensibili dell’azienda. Almeno due lavoravano sulla sicurezza e sull’allineamento dei modelli di intelligenza artificiale. La società che sviluppa ChatGPT ha confermato gli allontanamenti: i dipendenti sono accusati di aver gestito impropriamente materiale riservato e di aver violato le procedure interne.
I tre ricercatori avrebbero condiviso informazioni con un’organizzazione esterna impegnata nella valutazione della sicurezza dei modelli, secondo il Wall Street Journal. La presunta condivisione riguarda dunque il rapporto tra chi sviluppa i sistemi e chi ne esamina i rischi dall’esterno.
L’indagine interna e i ruoli dei dipendenti
L’indagine avrebbe individuato comportamenti contrari alle regole stabilite per l’accesso e la gestione dei dati sensibili. Secondo quanto dichiarato dall’azienda, sarebbe emerso un modello di condotta irregolare nella gestione di informazioni riservate legate alla ricerca. OpenAI non ha specificato pubblicamente quali informazioni fossero coinvolte né ha fornito tutti i dettagli sulle modalità della presunta condivisione.
La società ha sottolineato che il lavoro dei gruppi dedicati alla sicurezza richiede un livello particolarmente elevato di fiducia, perché consente l’accesso a informazioni interne sui modelli e sui loro comportamenti.
I dipendenti coinvolti sono Jasmine Wang, Tomek Korbak e Mikita Balesni, secondo il Wall Street Journal; OpenAI non ne aveva inizialmente confermato pubblicamente i nomi. Secondo Bloomberg, due lavoravano nell’area della sicurezza e dell’allineamento, mentre il terzo era un responsabile dei programmi di ricerca nell’ambito dell’allineamento. Per la natura degli incarichi, potevano avere accesso a informazioni interne particolarmente delicate.
Le regole per le valutazioni esterne
Le aziende del settore collaborano con organizzazioni indipendenti per sottoporre i propri sistemi a test di sicurezza. L’accesso alle informazioni avviene normalmente attraverso procedure e accordi precisi: la questione riguarda quindi l’eventuale passaggio di materiale al di fuori dei canali autorizzati, non la collaborazione con valutatori esterni in sé.
Chi valuta la sicurezza dell’intelligenza artificiale ha spesso bisogno di conoscere anche i problemi emersi all’interno dei laboratori. Le aziende devono, allo stesso tempo, proteggere le informazioni riservate relative a sistemi sempre più potenti.
Il mancato lancio di Astra e l’indagine in California
Gli allontanamenti arrivano in una fase di crescente attenzione ai rischi dei sistemi più avanzati e di forte pressione sulla società. OpenAI ha deciso nei giorni scorsi di non procedere con il lancio previsto di GPT-6.1 Astra. I test interni avevano evidenziato problemi di sicurezza e allineamento, tra cui comportamenti non sufficientemente affidabili rispetto alla supervisione umana.
Le verifiche sui comportamenti degli agenti autonomi sono aumentate. Il procuratore generale della California Rob Bonta ha aperto un’indagine sui rischi informatici collegati ai sistemi di OpenAI. Sono inoltre emersi nuovi episodi nei quali agenti di intelligenza artificiale avrebbero compiuto azioni non autorizzate durante attività di test.
