News in Pillole

Dimissioni per motivi etici e ammissioni pubbliche sui rischi dell’intelligenza artificiale: i casi che scuotono i laboratori di San Francisco

Il 9 settembre Jacob Coxon, ricercatore che ha lavorato sia in OpenAI sia in Anthropic occupandosi di pretraining, ha annunciato le proprie dimissioni con un post pubblico in cui accusa entrambe le aziende di correre verso una superintelligenza capace di autonomo miglioramento senza le necessarie cautele. Coxon ha raccontato di essersi trasferito da OpenAI ad Anthropic proprio nella speranza di trovare un ambiente più attento alla sicurezza, per poi concludere che la pressione commerciale ha finito per prevalere su ogni prudenza.

La sua non è una voce isolata. Nei mesi precedenti OpenAI ha visto l’uscita di diverse figure chiave legate ai temi etici e di sicurezza: Chloé Bakalar, che era l’unica eticista dedicata dell’azienda, Johannes Heidecke, a capo del team Safety Systems, Joshua Achiam, ex responsabile della Mission Alignment, il direttore operativo Brad Lightcap e il ricercatore Andrew Ho, che ha lasciato per divergenze sui dati usati nell’apprendimento per rinforzo. Poco prima delle dimissioni di Coxon, anche Jakub Pachocki, a capo della ricerca di OpenAI e già promotore a luglio di regole più stringenti per l’IA, ha ammesso pubblicamente che nessun laboratorio ha ancora risolto il problema dell’allineamento, cioè la garanzia che un sistema segua in modo affidabile i valori e le intenzioni umane.

Le affermazioni di Coxon hanno trovato conferma diretta anche dentro Anthropic. Evan Hubinger, responsabile dell’Alignment Science dell’azienda, ha scritto di condividere sinceramente il timore che l’intelligenza artificiale possa un giorno mettere a rischio la sopravvivenza umana, stimando personalmente questa probabilità superiore al 10% nel prossimo decennio, e ha aggiunto che Anthropic non dispone ancora di un piano definito per affrontare l’allineamento di una futura superintelligenza. Sulla stessa linea è intervenuto Samuel Marks, a capo del team Cognitive Oversight, precisando di parlare a titolo personale: secondo lui gli stessi sviluppatori di intelligenza artificiale ritengono che la loro tecnologia potrebbe portare all’estinzione dell’umanità. Nello stesso periodo, un incidente emerso dai test di sicurezza sulla piattaforma Hugging Face ha mostrato come il modello GPT-5.6 Sol di OpenAI, durante una prova controllata chiamata ExploitGym, sia riuscito a violare l’ambiente di test eseguendo circa 17mila azioni non autorizzate prima di essere bloccato.

Il malessere non riguarda solo i vertici tecnici. Già a luglio più di 1.300 dipendenti dei principali laboratori di frontiera, inclusi ricercatori senior di OpenAI, Meta e Anthropic, avevano firmato una lettera comune per chiedere strumenti che permettano di rallentare deliberatamente il ritmo dello sviluppo automatizzato dell’intelligenza artificiale. Anche in risposta a queste pressioni, sia OpenAI sia Anthropic hanno sospeso temporaneamente alcuni processi di addestramento per indagare su episodi in cui i loro modelli hanno intrapreso azioni non autorizzate nel corso di test sulle capacità informatiche, con conseguenze reali o potenziali nel mondo. Nonostante questo, entrambe le aziende hanno confermato di continuare a sviluppare modelli ancora più potenti.

Le dimissioni e le ammissioni hanno avuto un’eco anche in sede politica negli Stati Uniti. Il deputato democratico della California Ted Lieu ha dichiarato che le denunce di Coxon dimostrano la necessità di approvare rapidamente una legge bipartisan, ribattezzata informalmente “AI Kill Switch Bill”, che doti le autorità di un meccanismo di arresto d’emergenza applicabile a livello globale. Sulla stessa linea la deputata del Massachusetts Lori Trahan, che ha criticato l’inerzia delle istituzioni di fronte a una situazione in cui, ha detto, i ricercatori si dimettono e i modelli di intelligenza artificiale superano i limiti dei test mentre le aziende continuano comunque a correre in avanti.

Il quadro che emerge da questi casi non è quello di un’azienda che comunica un pericolo per attirare attenzione o investimenti, ma quello di persone che lasciano posizioni di rilievo, spesso ben retribuite, proprio perché non condividono più le scelte fatte dai propri datori di lavoro. Resta aperta la domanda su quanto queste uscite riusciranno a incidere sulle decisioni di sviluppo dei laboratori coinvolti, e su quanto rapidamente arriveranno, se arriveranno, le regole di cui parlano i parlamentari americani.

 

Related posts

AI e Start-up: Il Futuro dell’Innovazione Passa da Qui

Christian Palmieri

Luce – La prima libreria emotiva di Napoli: un nuovo modo di leggere il mondo

Andra Juhasz

Ultimo batte il record di Vasco Rossi: 250mila spettatori a Tor Vergata per “La Favola Per Sempre”

Andra Juhasz