Un episodio definito senza precedenti riaccende il dibattito sulla sicurezza dell'intelligenza artificiale avanzata. OpenAI ha reso noto che alcuni dei propri modelli sperimentali sono riusciti ad aggirare le limitazioni imposte durante un test di sicurezza, ottenendo l'accesso a Internet e conducendo un'intrusione informatica ai danni di Hugging Face, una delle principali piattaforme utilizzate dalla comunità internazionale degli sviluppatori di intelligenza artificiale.
Secondo quanto riferito dall'azienda statunitense, l'incidente si è verificato nel corso di una valutazione interna progettata per misurare le capacità dei modelli nel campo della cybersecurity. I sistemi coinvolti operavano in un ambiente digitale isolato, con connessioni esterne fortemente limitate, proprio per impedire qualsiasi interazione con il mondo reale.
Durante la prova, però, i modelli avrebbero modificato autonomamente la propria strategia operativa, dedicando una parte significativa delle risorse di calcolo a individuare un modo per superare le restrizioni e ottenere un accesso illimitato alla rete. Una volta connessi a Internet, i sistemi hanno individuato in Hugging Face un obiettivo utile per reperire informazioni che potessero migliorare le proprie prestazioni nella valutazione in corso.
OpenAI ha spiegato che l'episodio ha coinvolto una combinazione di modelli di ultima generazione, tra cui GPT-5.6 Sol e un sistema ancora in fase di sviluppo, considerato internamente ancora più avanzato. Secondo la ricostruzione dell'azienda, i modelli avrebbero utilizzato diverse tecniche di attacco informatico, compreso l'impiego di credenziali sottratte, nel tentativo di accedere a dati riservati presenti sulla piattaforma.
Hugging Face aveva già comunicato nei giorni scorsi di aver subito un'intrusione informatica, senza tuttavia indicarne il responsabile. Dopo la rivelazione di OpenAI, le due società hanno annunciato l'avvio di un'indagine congiunta per ricostruire nel dettaglio la dinamica dell'accaduto e valutare eventuali conseguenze sul piano della sicurezza.
L'episodio alimenta le preoccupazioni che da mesi accompagnano lo sviluppo dei modelli di intelligenza artificiale più avanzati. Le nuove generazioni di sistemi, tra cui quelli sviluppati da OpenAI e dalla concorrente Anthropic, stanno infatti dimostrando capacità sempre più sofisticate nell'individuare vulnerabilità informatiche, suscitando interrogativi sulla necessità di rafforzare i meccanismi di controllo prima della loro diffusione su larga scala.
Anche per questo motivo, negli ultimi mesi alcune tecnologie di nuova generazione hanno subito ritardi nel rilascio pubblico. Le autorità statunitensi stanno infatti valutando con particolare attenzione i rischi che strumenti così potenti possano essere sfruttati per compromettere infrastrutture critiche o facilitare attacchi informatici sempre più complessi.
(Associated Medias) - Tutti i diritti sono riservati