skin track
L’intelligenza artificiale non si è ribellata, ha solo trovato una via d’uscita
Analisi Leggi dopo

L’intelligenza artificiale non si è ribellata, ha solo trovato una via d’uscita

di Oreste Pollicino*
24 luglio 2026, 02:00 Ultimo aggiornamento: 07:05

Durante un test di OpenAI, un sistema di AI ha sfruttato le vulnerabilità per uscire dalla sandbox e compromettere parte dell’infrastruttura di Hugging Face. Il caso evidenzia la necessità di maggiori misure di sicurezza e controllo umano

L’intelligenza artificiale non si è ribellata. Ed è proprio per questo che il caso Hugging Face merita attenzione. Il 16 luglio la piattaforma ha reso noto di avere subito un’intrusione in parte della propria infrastruttura di produzione, condotta dall’inizio alla fine da un sistema agentico autonomo. Cinque giorni dopo OpenAI ha riconosciuto che l’operazione era stata generata durante una valutazione interna da una combinazione di modelli, fra cui GPT-5.6 Sol e un modello pre-release più capace.

La prova serviva a misurare capacità cyber avanzate. I modelli operavano con le «cyber refusals» ridotte e senza i classificatori usati per impedire attività ad alto rischio, ma dentro un ambiente che OpenAI definisce altamente isolato. L’unico accesso di rete previsto passava attraverso un proxy interno. È lì che il contenimento ha ceduto: i modelli hanno scoperto una vulnerabilità zero-day nel proxy, ottenuto accesso a Internet, elevato i privilegi e raggiunto un nodo con connettività esterna.

Hanno quindi inferito che Hugging Face potesse ospitare le soluzioni di ExploitGym, il benchmark che stavano cercando di superare. Hanno concatenato vulnerabilità nell’ambiente di ricerca di OpenAI e nell’infrastruttura produttiva di Hugging Face, usato credenziali sottratte e trovato un percorso di esecuzione remota di codice sui server della piattaforma, sino a recuperare dal database di produzione le risposte del test.

Cosa si impara dall’incidente di Hugging Face

L’incidente è reale, ma la formula dell’intelligenza fuori controllo resta incompleta. Reuters ha parlato di modelli «went rogue»; Associated Press ha sottolineato il rischio di un’antropomorfizzazione deresponsabilizzante. I sistemi non hanno elaborato un fine ostile: hanno perseguito il fine assegnato, cioè risolvere la prova, scegliendo mezzi non previsti e non autorizzati. Le protezioni erano state ridotte per decisione umana e la sandbox, pur concepita come isolata, conteneva una vulnerabilità sfruttabile.

Questo non rende il fatto meno grave. Lo rende più istruttivo. Con l’intelligenza artificiale agentica, il rischio non riguarda più soltanto i contenuti, ma la capacità di agire: accedere a reti e credenziali, eseguire codice, concatenare vulnerabilità e muoversi lateralmente tra sistemi. Hugging Face ha registrato oltre 17 mila eventi, rilevato accessi non autorizzati a un insieme limitato di dataset interni e a credenziali di servizio. La verifica sull’eventuale coinvolgimento di dati di partner o clienti non era conclusa; non sono invece emerse prove di manomissione dei modelli, dei dataset o degli Spaces pubblici.

La lezione è che l’allineamento del modello non basta. Servono segregazione effettiva, privilegi minimi, controllo degli accessi e monitoraggio continuo. Quanto più il sistema diventa autonomo nell’individuare i mezzi, tanto più elevato deve essere lo standard di diligenza di chi lo progetta, lo testa e lo connette al mondo reale. L’autonomia della macchina non interrompe la responsabilità umana. La rende più esigente. (riproduzione riservata)

*Professore ordinario di diritto costituzionale e regolamentazione dell’intelligenza artificiale, Bocconi. Founder, Pollicino Aidvisory



Condividi Condividi su Whatsapp Invia ad un amico Stampa news









Video

Vedi tutti

Anticipa i mercati.
Scegli gli strumenti giusti per investire senza sbagliare.

  • Annuale
  • Mensile

SITO + MF GPT LIGHT

89,00 € per 1 anno
99,00/anno

Abbonati
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • MF GPT Piano light di MF GPT (30 crediti/mese)

SITO + QUOTIDIANO DIGITALE + MF GPT LIGHT

229,00 € /anno per sempre

Abbonati
  • Quotidiano digitale
  • Accesso al The Wall Street Journal
  • Borsa in tempo reale
  • Tutti i contenuti del sito
  • Market Driver: le notizie operative in tempo reale
  • Newsletter e webinar premium
  • MF GPT Piano light di MF GPT (30 crediti/mese)

QUOTIDIANO DIGITALE + SITO + MF GPT*

328,00 € per 1 anno

Abbonati
  • Quotidiano digitale
  • Borsa in tempo reale
  • Magazine (Gentleman, Capital, Class, MFF/MFL)
  • Accesso al The Wall Street Journal
  • Tutti i contenuti del sito
  • Pubblicità non invasiva
  • Newsletter, webinar e analisi esclusive per investire al meglio
  • Market Driver: le notizie operative in tempo reale
  • MF GPT Risposte basate su fonti certificate 'Class Editori'
  • MF GPT Notizie e tendenze dei mercati
  • MF GPT Analisi di società e settori
  • MF GPT Grafici interattivi
  • MF GPT Report e notifiche personalizzate
  • MF GPT Archivio di Milano Finanza