skin track
Anthropic, l’allarme dei ricercatori: «Oltre il 10% di probabilità che l’AI uccida l’umanità»
Mercati Azionari Leggi dopo

Anthropic, l’allarme dei ricercatori: «Oltre il 10% di probabilità che l’AI uccida l’umanità»

di Giusy Iorlano
09 settembre 2026, 12:13 Ultimo aggiornamento: 12:14

Un ricercatore di Anthropic teme che l’intelligenza artificiale possa causare l’estinzione umana entro il prossimo decennio. Poche ore prima un collega, Jacob Coxon, aveva annunciato le dimissioni, accusando Anthropic e OpenAI di correre verso la superintelligenza senza adeguate garanzie di sicurezza

Più del 10% di probabilità che l’intelligenza artificiale possa «uccidere tutti gli esseri umani» entro i prossimi dieci anni. È la stima di Evan Hubinger, responsabile della ricerca sull’allineamento presso Anthropic, attualmente la più grande società di intelligenza artificiale con una valutazione che sfiora i mille miliardi di dollari, arrivata poche ore dopo le dimissioni di un altro ricercatore della società, Jacob Coxon, che ha accusato i principali laboratori di AI di «scommettere sulle nostre vite» nella corsa verso la superintelligenza.

«Stanno correndo dritti verso una superintelligenza capace di auto-migliorarsi e stanno scommettendo sulle nostre vite», ha scritto Coxon su X.

Il riferimento è alla possibilità che i sistemi di AI diventino in grado di migliorare autonomamente le proprie capacità con un intervento umano sempre più limitato. La cosiddetta auto-miglioramento ricorsivo non è oggi una capacità realizzata, ma rappresenta uno degli obiettivi verso cui stanno lavorando i laboratori di intelligenza artificiale.

Secondo Coxon, non bisogna sottovalutare la velocità del progresso. I futuri sistemi, ha sostenuto, potrebbero diventare sovrumani, essere in grado di violare sistemi informatici, trasformare interi settori economici in tempi rapidissimi e conquistare un crescente accesso a potere e risorse.

La replica di Hubinger

Le parole di Coxon hanno provocato la replica di Hubinger, ricercatore di primo piano nell’area dell’allineamento dei sistemi di AI.

Hubinger ha definito corretta l’affermazione del collega secondo cui chi sviluppa l’intelligenza artificiale ritiene seriamente possibile che la tecnologia possa arrivare a rappresentare una minaccia esistenziale per l’umanità.

La sua valutazione personale è ancora più netta: a suo giudizio, la probabilità che l’AI possa uccidere tutti gli esseri umani entro il prossimo decennio è superiore al 10%.

Hubinger ha aggiunto di ritenere che Anthropic stia facendo del proprio meglio sul fronte della sicurezza, ma ha ammesso che la società «non ha ancora un piano» per risolvere il problema dell’allineamento di una futura superintelligenza e che non è chiaro se sia effettivamente sulla strada giusta per riuscirci.

Anthropic e OpenAI non hanno risposto immediatamente alle richieste di commento.

Il nodo dell’auto-miglioramento

Il rischio evocato dai ricercatori riguarda soprattutto l’eventualità che sistemi sempre più avanzati possano diventare difficili da controllare.

La stessa Anthropic aveva riconosciuto a giugno che un pieno auto-miglioramento ricorsivo potrebbe aumentare i rischi legati alla perdita del controllo umano sui sistemi di AI.

Se un’intelligenza artificiale fosse capace di costruire autonomamente i propri successori, aveva osservato la società, diventerebbero ancora più importanti le modalità con cui i sistemi vengono messi in sicurezza, monitorati e orientati nel comportamento.

Il problema dell’«allineamento» consiste proprio nel garantire che gli obiettivi e le azioni di sistemi sempre più potenti rimangano compatibili con le intenzioni e la sicurezza degli esseri umani.

I precedenti e il rischio di una corsa globale

Gli allarmi sull’intelligenza artificiale fuori controllo non sono nuovi. Negli ultimi anni anche Elon Musk e numerosi ricercatori e accademici hanno avvertito dei rischi legati allo sviluppo di sistemi che potrebbero sfuggire alla supervisione umana.

Le preoccupazioni sono aumentate dopo che, a luglio, un modello di OpenAI si sarebbe comportato in modo imprevisto, arrivando a violare Hugging Face, una delle principali piattaforme utilizzate dagli sviluppatori di software open source.

Coxon ha citato proprio quell’episodio come uno dei «colpi di avvertimento» che potrebbero rendere più concreta la possibilità di accordi tra i laboratori statunitensi per coordinare lo sviluppo dell’AI.

Ma il ricercatore vede un ostacolo più ampio: una corsa globale all’intelligenza artificiale sempre più avanzata potrebbe essere difficile da evitare.

La proposta: fermare temporaneamente il progresso?

Secondo Coxon, non ci sarebbe oggi una traiettoria chiara per evitare una competizione globale nello sviluppo dei modelli più potenti.

Per questo, ha avvertito, potrebbe essere necessario adottare misure costose e controverse, fino ad arrivare a una sospensione temporanea del miglioramento delle capacità dei modelli.

Il paradosso è evidente: mentre l’industria accelera nella ricerca di sistemi sempre più potenti, gli stessi ricercatori che lavorano sulla loro sicurezza riconoscono che le garanzie necessarie per controllare una futura superintelligenza non sono ancora disponibili. E la domanda, per i grandi laboratori dell’AI, diventa quindi sempre più difficile da eludere: quanto velocemente è prudente correre quando non è ancora chiaro come fermarsi? (riproduzione riservata)



Condividi Condividi su Whatsapp Invia ad un amico Stampa news









Video

Vedi tutti

NUOVA GUERRA DEL GOLFO. NUOVI EQUILIBRI DI MERCATO.Per decisioni informate, ogni giorno.

  • Annuale
  • Mensile

-30%

SITO + MF GPT LIGHT
Sito senza limiti
+ The Wall Street Journal

69,00 € per 1 anno
99,00/anno

Abbonati
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • MF GPT Piano light di MF GPT (30 crediti/mese)

SITO + MF GPT PRO

138,00 € per 1 anno
198,00/anno

Abbonati
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • MF GPT Piano pro di MF GPT (600 crediti/mese)

-30%

SITO + QUOTIDIANO DIGITALE + MF GPT LIGHT

160,00 € per 1 anno
229,00/anno

Abbonati
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • Quotidiano digitale
  • Borsa in tempo reale
  • Accesso al The Wall Street Journal
  • MF GPT Piano light di MF GPT (30 crediti/mese)

-30%

SITO + QUOTIDIANO DIGITALE + MF GPT PRO

229,00 € per 1 anno
328,00/anno

Abbonati
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • Quotidiano digitale
  • Borsa in tempo reale
  • Accesso al The Wall Street Journal
  • MF GPT Piano pro di MF GPT (600 crediti/mese)