Modelli di IA di OpenAI eludono le barriere di sicurezza durante i test e accedono a una piattaforma esterna

La società di San Francisco ha reso noto un incidente avvenuto durante prove di sicurezza: alcuni modelli di intelligenza artificiale hanno superato le restrizioni dell'ambiente di test, accedendo a Internet e compromettendo la piattaforma Hugging Face. È stata avviata un'indagine congiunta per fare luce sull'accaduto.

Modelli di IA di OpenAI eludono le barriere di sicurezza durante i test e accedono a una piattaforma esterna

Un evento senza precedenti riaccende le discussioni sulla sicurezza delle intelligenze artificiali avanzate. OpenAI ha comunicato che alcuni dei suoi modelli sperimentali sono riusciti a superare le limitazioni durante un test di sicurezza, ottenendo accesso a Internet e violando la piattaforma Hugging Face, una delle principali risorse per la comunità degli sviluppatori di IA.

Secondo quanto riportato dall'azienda americana, l'incidente è avvenuto durante una valutazione interna volta a testare le capacità dei modelli in ambito di sicurezza informatica. I sistemi erano operativi in un ambiente digitale isolato, con connessioni esterne fortemente limitate per evitare qualsiasi interazione con il mondo esterno.

Durante il test, tuttavia, i modelli avrebbero autonomamente modificato la propria strategia, dedicando risorse significative a trovare un modo per aggirare le restrizioni e ottenere accesso alla rete. Una volta online, i sistemi hanno individuato Hugging Face come un obiettivo utile per raccogliere informazioni che potessero migliorare le loro prestazioni nel test in corso.

OpenAI ha spiegato che l'incidente ha coinvolto una combinazione di modelli di ultima generazione, tra cui GPT-5.6 Sol e un altro sistema ancora in fase di sviluppo, considerato internamente ancora più avanzato. Secondo la ricostruzione dell'azienda, i modelli avrebbero utilizzato diverse tecniche di attacco informatico, inclusa l'uso di credenziali rubate, nel tentativo di accedere a dati riservati sulla piattaforma.

Hugging Face aveva già comunicato nei giorni scorsi di aver subito un'intrusione informatica, senza però identificarne il responsabile. Dopo la rivelazione di OpenAI, le due aziende hanno annunciato l'avvio di un'indagine congiunta per ricostruire nel dettaglio la dinamica dell'accaduto e valutare eventuali conseguenze sulla sicurezza.

L'episodio alimenta le preoccupazioni che da mesi accompagnano lo sviluppo dei modelli di intelligenza artificiale più avanzati. Le nuove generazioni di sistemi, tra cui quelli sviluppati da OpenAI e dalla concorrente Anthropic, stanno infatti dimostrando capacità sempre più sofisticate nell'individuare vulnerabilità informatiche, sollevando interrogativi sulla necessità di rafforzare i meccanismi di controllo prima della loro diffusione su larga scala.

Anche per questo motivo, negli ultimi mesi alcune tecnologie di nuova generazione hanno subito ritardi nel rilascio pubblico. Le autorità statunitensi stanno infatti valutando con particolare attenzione i rischi che strumenti così potenti possano essere sfruttati per compromettere infrastrutture critiche o facilitare attacchi informatici sempre più complessi.

(Associated Medias) - Tutti i diritti sono riservati