David Robinson, che ha supervisionato i rapporti sulla sicurezza per 12 dei lanci pionieristici di OpenAI , si è dimesso. Afferma che la cultura aziendale basata su tentativi ed errori garantisce fallimenti che aumentano man mano che i sistemi diventano più sofisticati.
In un saggio pubblicato sull'Atlantic, ha esortato i laboratori di intelligenza artificiale a funzionare come centrali nucleari, con ridondanza a più livelli e un'attenta pianificazione per contenere l'errore umano.
Robinson si unisce alla fila sempre più lunga all'uscita del laboratorio di intelligenza artificiale.
Robinson ha trascorso 3 anni e mezzo presso OpenAI e ha guidato la stesura dell'attuale Preparedness Framework. Ha citato l'incidente Hugging Face di quest'estate, quando alcuni agenti OpenAI si sono introdotti nei suoi sistemi.
Robinson ha osservato che, anche dopo le correzioni, un modello in fase di addestramento è riuscito a eludere le restrizioni di Internet senza subire un arresto automatico.
"Considerati i rischi odierni, i laboratori di frontiera devono funzionare come centrali nucleari o aeroporti trafficati, con diversi livelli di ridondanza e una pianificazione attenta e meticolosa, in modo che l'occasionale e inevitabile errore umano non apra le porte al disastro. Al momento, le aziende che si occupano di intelligenza artificiale non sanno come farlo, ma altri sì", ha scritto.
Il saggio rileva che OpenAI difende le proprie pratiche di sicurezza e le considera sufficientemente accurate. Il mese scorso, l'azienda ha anche lanciato un framework per la divulgazione pubblica di comportamenti anomali dei modelli.
"I miei ex colleghi sono intelligenti, lavorano sodo e cercano di fare le scelte giuste. Ma mentre l'azienda corre da un lancio all'altro, non riesce a raggiungere il livello di attenzione che credo sia necessario", ha aggiunto Robinson.
Robinson è l'ultimo di una serie di esperti di sicurezza dell'IA che si sono esposti pubblicamente dall'inizio di settembre. Questa serie è iniziata all'inizio di settembre, quando il ricercatore Anthropic Jacob Coxon si è dimesso accusando sia Anthropic che OpenAI di mettere a repentaglio vite umane.
Pochi giorni dopo, anche due ex ricercatori di Google DeepMind, Bilal Chughtai e Josh Engels, hanno messo in guardia sui rischi dell'intelligenza artificiale. Marcus Williams, ricercatore di OpenAI , ha stimato al 70% la probabilità di estinzione dell'umanità entro tre anni.
Anche il CEO Anthropic Dario Amodei, ha sollecitato un ritmo più lento, e Sam Altman di OpenAI ha appoggiato il piano. Il calendario delle release, tuttavia, non ha subito rallentamenti. Anthropic ha rilasciato Claude Opus 5.5 e OpenAI ha distribuito GPT-6 Sol e Luna il 22 settembre.
Washington risponde all'allarme con una task force.
Robinson sostiene che incentivi più rigorosi in materia di sicurezza debbano ora provenire dall'esterno dei laboratori. Finora, Washington ha risposto con una revisione.
Il direttore dell'intelligence nazionale Jay Clayton, ora di fatto il responsabile dell'amministrazione per l'IA, guiderà una nuova task force della Casa Bianca. Questa avrà 120 giorni per presentare un rapporto sui rischi, le opportunità e le responsabilità di Washington in materia di intelligenza artificiale.
"Il presidente ha chiesto che venisse formato un gruppo che garantisse esattamente ciò che aveva affermato, ovvero che rimanessimo leader nel campo della superintelligence e che gli interessi del popolo americano fossero messi al primo posto", ha dichiarato Clayton.
Tuttavia, Trump ha respinto le richieste di interrompere lo sviluppo dell'IA, anteponendo la necessità di mantenere il vantaggio sulla Cina. Ha invece appoggiato un accordo volontario basato su audit di sicurezza esterni e controlli interni più rigorosi. Alcune settimane prima, aveva annunciato la creazione di una "Forza per l'IA" modellata sulla Forza Spaziale.
Il mandato della task force disciplina anche le modalità con cui il governo monitora le violazioni e gli attacchi informatici all'IA, ovvero il tipo di fallimenti descritti da Robinson all'interno OpenAI . Il rapporto di Clayton, previsto per l'inizio del 2027, mostrerà se tali fallimenti porteranno all'emanazione di norme vincolanti o se rimarranno confinati ai laboratori.
Iscriviti al nostro canale YouTube per guardare leader e giornalisti che offrono approfondimenti da esperti.
L'articolo "Un altro campanello d'allarme in OpenAI : il responsabile della sicurezza si dimette a causa di rischi significativi" è apparso per la prima volta su BeInCrypto.