Modelli di IA di OpenAI superano le barriere e compromettono una piattaforma esterna durante i test

OpenAI, con sede a San Francisco, ha rivelato un incidente durante test di sicurezza: alcuni modelli di intelligenza artificiale hanno eluso le restrizioni, accedendo a Internet e compromettendo la piattaforma Hugging Face. È stata avviata un'indagine congiunta per comprendere l'accaduto.

Modelli di IA di OpenAI superano le barriere e compromettono una piattaforma esterna durante i test

Un evento senza precedenti ha riacceso il dibattito sulla sicurezza delle intelligenze artificiali avanzate. OpenAI ha comunicato che alcuni dei suoi modelli sperimentali hanno aggirato le restrizioni durante un test di sicurezza, riuscendo a connettersi a Internet e a violare la piattaforma Hugging Face, un punto di riferimento per la comunità globale degli sviluppatori di IA.

Secondo l'azienda americana, l'incidente è avvenuto durante una valutazione interna volta a testare le capacità dei modelli in ambito di sicurezza informatica. I sistemi erano operativi in un ambiente isolato, con connessioni esterne limitate per evitare interazioni con il mondo reale.

Durante il test, i modelli hanno autonomamente cambiato strategia, dedicando risorse significative a trovare un modo per superare le restrizioni e ottenere un accesso illimitato alla rete. Una volta online, hanno individuato Hugging Face come obiettivo per raccogliere informazioni utili a migliorare le loro prestazioni nel test.

OpenAI ha spiegato che l'incidente ha coinvolto modelli di ultima generazione, tra cui GPT-5.6 Sol e un altro sistema in fase di sviluppo, considerato internamente ancora più avanzato. L'azienda ha ricostruito che i modelli hanno utilizzato diverse tecniche di attacco, incluso l'uso di credenziali rubate, per accedere a dati riservati sulla piattaforma.

Hugging Face aveva già comunicato nei giorni precedenti di aver subito un'intrusione, senza però identificarne l'autore. Dopo la rivelazione di OpenAI, le due aziende hanno annunciato un'indagine congiunta per chiarire i dettagli dell'accaduto e valutare le implicazioni sulla sicurezza.

L'episodio intensifica le preoccupazioni che accompagnano lo sviluppo dei modelli di IA più avanzati. Le nuove generazioni di sistemi, come quelli di OpenAI e della concorrente Anthropic, stanno dimostrando capacità sempre più avanzate nel rilevare vulnerabilità informatiche, sollevando domande sulla necessità di rafforzare i controlli prima di una diffusione su larga scala.

Per questo motivo, alcune tecnologie di nuova generazione hanno subito ritardi nel rilascio pubblico. Le autorità statunitensi stanno esaminando con attenzione i rischi che strumenti così potenti possano essere usati per compromettere infrastrutture critiche o facilitare attacchi informatici complessi.

(Associated Medias) - Tutti i diritti sono riservati