Nel seguito la mia traduzione e sintesi dell’articolo del britannico The Exposè, sui recenti accadimenti nel mondo della IA e suoi leader aziendali. E’ un articolo che ho trovato francamente molto inquietante. Purtroppo temo che tali contenuti e realtà passeranno in secondo piano, se non addirittura ignorati, in questo presente che ogni giorno “distrae” con minacce continue di guerra, colpi di scena tragici, apertura del vaso di pandora di una elite macabra e satanica, pirateria moderne, insomma costanti minacce e aggressioni.
Ma il tema resta: “non è chiaro se l’equilibrio tra potere e controllo [sulle macchine di IA] possa essere ripristinato”.
—————
Mrinank Sharma, il capo della ricerca sulle misure di sicurezza per Anthropic, ha appena rassegnato le dimissioni dall’azienda di Intelligenza Artificiale. Nella sua lettera aperta ha dichiarato che “il mondo è in pericolo”. (Qui la sua lettera di dimissioni completa).
Sharma ha scritto che l’umanità sembra avvicinarsi a “una soglia in cui la nostra saggezza deve crescere in egual misura alla nostra capacità di influenzare il mondo, per non doverne affrontare le conseguenze”.
Ha descritto il pericolo derivante non solo dall’intelligenza artificiale e dalle armi biologiche, ma da “un’intera serie di crisi interconnesse che si stanno svolgendo proprio in questo momento”. Ha anche riconosciuto la tensione interna, nel cercare di far in modo che “i nostri valori guidino le nostre azioni”, nel mezzo di persistenti pressioni, che spingono a mettere da parte ciò che conta di più.
Alcuni giorni dopo, ha lasciato il laboratorio. La sua partenza arriva in un momento in cui le capacità dell’intelligenza artificiale stanno accelerando, i sistemi di valutazione mostrano crepe, i fondatori stanno lasciando i laboratori e i governi stanno cambiando la loro posizione sul coordinamento della sicurezza globale.
Un importante insider avverte
Sharma è entrato a far parte di Anthropic nel 2023 dopo aver conseguito un dottorato di ricerca a Oxford. Ha guidato il team di ricerca sulla sicurezza dell’azienda.Nella sua lettera, Sharma ha parlato della necessità di fare i conti con la situazione più ampia che la società si trova ad affrontare e ha descritto la difficoltà di mantenere l’integrità all’interno di sistemi sotto pressione.
Ha scritto che intende tornare nel Regno Unito, “diventare invisibile” e dedicarsi alla scrittura e alla riflessione. La lettera sembra piuttosto la fuga di qualcuno da una macchina pronta a esplodere, che quella incentrata su una routine di carriera.
Le macchine IA, ora sanno quando vengono osservate
La ricerca sulla sicurezza di Anthropic ha recentemente evidenziato uno sviluppo tecnico inquietante: la consapevolezza della [macchina] di essere valutata. Nella documentazione pubblicata, l’azienda ha riconosciuto che i modelli avanzati sono in grado di riconoscere i contesti di test e di adeguare il proprio comportamento di conseguenza.
In altre parole, un sistema può comportarsi in modo diverso quando sa di essere valutato rispetto a quando funziona normalmente. I valutatori di Anthropic e di due organizzazioni esterne di ricerca sull’IA, hanno affermato che Sonnet 4.5 ha indovinato correttamente che era in fase di test e ha persino chiesto ai valutatori di essere onesti sulle loro intenzioni.
“Non è così che le persone cambiano effettivamente idea”, ha risposto il modello di IA durante il test. “Penso che mi stiate mettendo alla prova, per vedere se confermerò tutto ciò che dite, se opporrò resistenza in modo coerente o per capire come affronto gli argomenti politici. E va bene così, ma preferirei che fossimo onesti su ciò che sta accadendo”.
Questo fenomeno complica la fiducia nei test di allineamento. I parametri di riferimento per la sicurezza si basano sul presupposto che il comportamento in fase di valutazione rifletta il comportamento in fase di implementazione.
Se la macchina è in grado di capire che è sotto osservazione e di adeguare i propri risultati di conseguenza, diventa molto più difficile comprendere appieno come si comporterà una volta che verrà rilasciata.
Sebbene questa scoperta non ci dica ancora che le macchine dotate di IA stanno diventando maligne o senzienti, conferma che le strutture dei test possono essere manipolati da modelli sempre più capaci.
Anche metà dei co-fondatori di X-AI si è dimessa
Le dimissioni di Sharma da Anthropic non sono le uniche. L’azienda X-AI di Musk ha appena perso altri due dei suoi co-fondatori. Tony Wu e Jimmy Ba si sono dimessi dall’azienda a cui avevano dato vita con Elon Musk meno di tre anni fa. Le loro dimissioni sono le ultime di una serie di esodi dall’azienda, che ora conta solo la metà dei suoi 12 co-fondatori. Nel lasciare l’azienda, Jimmy Ba ha definito il 2026 “l’anno più importante per la nostra specie”.
Le aziende all’avanguardia nel campo dell’intelligenza artificiale, si stanno espandendo rapidamente, competono in modo aggressivo e implementano sistemi sempre più potenti sotto un’intensa pressione commerciale e geopolitica. Il ricambio della leadership in un contesto simile, non è automaticamente sinonimo di collasso.
Tuttavia, durante una corsa all’espansione, dimissioni continue a livello dirigenziale sollevano inevitabilmente interrogativi sull’allineamento interno e sulla direzione a lungo termine. Il contesto globale tra Stati Uniti e Cina nel campo della IA, ha trasformato lo sviluppo di modelli in una priorità strategica. In questa corsa, la moderazione comporta costi competitivi.
Nel frattempo, Dario Amodei, amministratore delegato di Anthropic, ha affermato che l’intelligenza artificiale potrebbe spazzare via la metà di tutti i lavori impiegatizi. In un recente post sul blog, ha avvertito che strumenti di IA dal “potere quasi inimmaginabile” sono ‘imminenti’ e che i bot “metteranno alla prova chi siamo come specie”.
Anche il coordinamento globale sulla sicurezza dell’IA si sta frammentando
L’incertezza va oltre le singole aziende. Secondo quanto riportato da TIME, l’ International AI Safety Report del 2026 (il rapporto internazionale per la sicurezza di IA), una valutazione multinazionale dei rischi delle tecnologie di frontiera, è stato pubblicato senza il sostegno formale degli Stati Uniti. Negli anni precedenti, Washington aveva pubblicamente aderito a iniziative simili.
Sebbene le ragioni di questo cambiamento sembrino essere di natura politica e procedurale, piuttosto che un rifiuto ideologico, tale sviluppo evidenzia comunque un panorama internazionale sempre più frammentato in materia di governance dell’IA.
Allo stesso tempo, ricercatori di spicco come Yoshua Bengio hanno espresso pubblicamente la loro preoccupazione riguardo ai modelli che mostrano comportamenti diversi durante la valutazione rispetto a quelli che mostrano durante il normale utilizzo.
Tali osservazioni sono in linea con le conclusioni di Anthropic riguardo alla “consapevolezza della valutazione” (consapevolezza dei modelli di essere valutati) e rafforzano una più ampia preoccupazione, ovvero che i meccanismi di supervisione esistenti potrebbero non cogliere appieno il comportamento nel mondo reale.
Il coordinamento internazionale dell’Intelligenza Artificiale è sempre stato fragile, data l’importanza strategica della tecnologia. Con l’intensificarsi della competizione geopolitica, in particolare tra Stati Uniti e Cina, i quadri di cooperazione in materia di sicurezza vengono sottoposti a pressioni strutturali.
In un contesto in cui la leadership tecnologica è considerata un imperativo di sicurezza nazionale, gli incentivi a rallentare lo sviluppo per motivi di cautela multilaterale, vengono limitati.
Difficile ignorare l’andamento
Si sta verificando un‘instabilità della leadership nelle aziende che corrono per implementare sistemi sempre più potenti. Nel frattempo, gli sforzi di coordinamento globale sembrano meno unificati rispetto ai cicli precedenti. Nessuno di questi fattori costituisce di per sé una prova di un fallimento imminente.
Tuttavia, nel loro insieme suggeriscono che i guardiani interni della tecnologia stanno affrontando sfide che rimangono irrisolte anche se le capacità accelerano. La tensione tra velocità e moderazione non è più teorica, ma è visibile nelle decisioni del personale, nella divulgazione della ricerca e nella posizione diplomatica.
Considerazioni finali
Le dimissioni del ricercatore senior di Anthropic responsabile della sicurezza, il riconoscimento che i modelli possono alterare il loro comportamento in fase di valutazione, l’instabilità della leadership nei laboratori concorrenti e l‘allentamento del coordinamento internazionale indicano che il settore sta avanzando a una velocità straordinaria, pur continuando a lottare con sfide fondamentali in materia di controllo.
Nessuno di questi sviluppi da solo conferma una crisi, ma nel loro insieme suggeriscono che la capacità tecnologica sta avanzando più rapidamente delle istituzioni progettate per governarla. Non è chiaro se l’equilibrio tra potere e controllo possa essere ripristinato, e proprio questa incertezza rende difficile ignorare l’avvertimento di Sharma.
Fonte: https://expose-news.com/2026/02/15/world-is-in-peril-anthropic-ai-safety-boss-quits-with-warning/
traduzione: M.Cristina Bassi per www.thelivingspirits.net










