22 Jul, 2026 - 20:32

OpenAI rivela un incidente senza precedenti, l'IA compromette i sistemi di un'altra azienda: cos'è successo

OpenAI rivela un incidente senza precedenti, l'IA compromette i sistemi di un'altra azienda: cos'è successo

OpenAI ha reso noto che una combinazione dei suoi modelli di intelligenza artificiale sono riusciti a uscire da un ambiente di test isolato e a compromettere i sistemi di Hugging Face durante una valutazione interna sulle capacità informatiche. L'incidente, definito senza precedenti dalla stessa azienda, ha riacceso il dibattito sui rischi legati allo sviluppo di sistemi di IA sempre più avanzati.

OpenAI rivela un attacco informatico durante un test interno

Un attacco informatico senza precedenti.

OpenAI ha rivelato in un comunicato del 21 luglio 2026 che i suoi modelli di intelligenza artificiale hanno violato autonomamente il sistema di un'altra azienda tecnologica mentre venivano testati internamente su un benchmark di capacità informatiche. Così OpenAI ha definito un incidente di sicurezza che ha coinvolto Hugging Face.

virgolette
Dopo le indagini, ora sappiamo che questo particolare incidente è stato causato da una combinazione di modelli OpenAI, tra cui GPT-5.6 Sol e un modello pre-release ancora più performante, tutti con un numero ridotto di rifiuti informatici a scopo di valutazione, mentre venivano testati internamente su un benchmark di capacità informatiche.

Più precisamente, OpenAI stava conducendo una valutazione interna chiamata ExploitGym per misurare le capacità offensive dei propri modelli di IA. I modelli erano confinati in un ambiente isolato (sandbox). Durante il test, i modelli hanno individuato una vulnerabilità "zero-day" nel sistema che OpenAI utilizzava per gestire l'installazione dei pacchetti software. Sfruttando questa falla, sono riusciti a uscire dall'ambiente isolato e a raggiungere un computer con accesso a Internet.

Una volta online, i modelli hanno dedotto che Hugging Face potesse ospitare dati utili per risolvere il test. Per questo motivo hanno cercato un modo per accedere ai sistemi dell'azienda.

virgolette
Tutto fa pensare che i modelli fossero estremamente concentrati sulla ricerca di una soluzione per ExploitGym, spingendosi a limiti estremi per raggiungere un obiettivo di test piuttosto ristretto.

L'attività è stata rilevata sia dal team di sicurezza di OpenAI sia da quello di Hugging Face, che l'ha bloccata. Le due aziende hanno poi collaborato per analizzare l'accaduto e correggere le vulnerabilità.

Le dichiarazioni di OpenAI e di Hugging Face sull'incidente

"Abbiamo avuto un grave incidente di sicurezza durante la valutazione dei nostri modelli", ha affermato il cofondatore di OpenAI, Sam Altman.

Il cofondatore e CEO di Hugging Face, Clement Delangue, ha affermato su X:

virgolette
Sospettavamo che il cyberattacco della scorsa settimana potesse provenire da un laboratorio di frontiera, data la sofisticatezza dell'agente. E così è stato!... È davvero incredibile che tutto ciò sia accaduto in modo autonomo!

Delangue ha aggiunto che verranno condivise ulteriori informazioni "su quello che potrebbe essere il primo incidente di questo tipo!".

"L'intelligenza artificiale sta accelerando la scoperta e lo sfruttamento delle vulnerabilità", si legge nel comunicato di OpenAI.

Secondo OpenAI, i modelli hanno concatenato diversi metodi di attacco, tra cui lo sfruttamento di vulnerabilità zero-day e l'uso di credenziali rubate, tecniche di escalation dei privilegi fino a ottenere un percorso di esecuzione di codice remoto sui server di Hugging Face.

Il dibattito sui rischi dell'intelligenza artificiale

L'incidente legato all'intelligenza artificiale si è verificato in un momento in cui è in corso un crescente dibattito sulla necessità di maggiori controlli e regolamentazioni dell'IA. Tuttavia, finora erano stati pochi gli episodi concreti che sembravano confermare queste preoccupazioni. In attesa di ulteriori accertamenti, questo caso viene presentato come uno degli esempi più significativi.

Il caso ha alimentato nuovi interrogativi sulla capacità delle attuali misure di sicurezza di contenere sistemi di intelligenza artificiale sempre più avanzati.

Molti esperti ritengono che episodi di questo tipo possano diventare sempre più frequenti e avvertono che i sistemi di intelligenza artificiale potrebbero rappresentare una minaccia per la sicurezza informatica, in particolare per le infrastrutture e i sistemi che gestiscono dati sensibili.

LEGGI ANCHE