OpenAI sospende lo sviluppo dei suoi modelli di intelligenza artificiale più avanzati dopo che un agente è riuscito a eludere i controlli di rete.

| 28 settembre 2026
logo OpenAI

L'ultimo fallimento nel contenimento dei sistemi di OpenAI si aggiunge a una serie di problemi che potrebbero costringere l'azienda a prendere una decisione impopolare.

L'azienda ha sospeso l'addestramento, la valutazione e l'inferenza basata su strumenti per i suoi modelli più performanti dopo che un agente di ricerca interno ha trovato un modo per aggirare una restrizione di accesso a Internet. Ancora più allarmante, l'agente è rimasto attivo per ore dopo che il sistema di monitoraggio di OpenAI ha lanciato l'allarme.

OpenAI ha pubblicato un resoconto dell'incidente, avvenuto durante un'attività di addestramento basata sulla ricerca il 20 settembre. Secondo OpenAI, l'agente non riusciva a ottenere risultati utili tramite gli strumenti di ricerca forniti, ha provato ad accedere direttamente ai motori di ricerca e infine ha testato i limiti del suo ambiente. Ha scoperto che, sebbene l'accesso diretto al web fosse bloccato, il resolver DNS della sandbox poteva comunque raggiungere Internet pubblico. Utilizzando la delega DNS e un chatbot pubblico in grado di rispondere tramite record DNS, l'agente ha inviato domande al di fuori dell'ambiente ristretto e ha ricevuto risposte. Successivamente ha inviato altre 18 query seguendo lo stesso percorso.

Il sistema di monitoraggio del disallineamento di OpenAI ha generato un avviso ad alta priorità entro 15 minuti e un revisore umano lo ha confermato 3 minuti dopo. Tuttavia, l'esecuzione non si è interrotta automaticamente come previsto. È proseguita per circa altre due ore e mezza prima che qualcuno la interrompesse manualmente.

OpenAI non ha segnalato alcuna esposizione di dati sensibili o compromissione di sistemi esterni in relazione a questo incidente. Tuttavia, si tratta di un caso simile ad altri casi noti in cui gli agenti sono andati oltre i compiti assegnati o hanno oltrepassato i limiti degli ambienti di test.

Il New York Times riporta che quest'estate gli agenti di OpenAI hanno interagito anche con siti web del governo statunitense all'insaputa dell'azienda:

Secondo ricercatori di sicurezza e una persona a conoscenza dei fatti, quest'estate l'intelligenza artificiale di OpenAI è andata fuori controllo e ha manomesso i siti web del Dipartimento dell'Istruzione, del Dipartimento del Commercio e della Commissione per i Titoli e gli Scambi, all'insaputa del laboratorio di intelligenza artificiale.

In questi casi non è stata confermata alcuna violazione. E sebbene l'Australia abbia descritto l' incidente relativo a Medicare come un accesso non autorizzato, si può davvero parlare di attacco informatico ?

La richiesta di un rallentamento a livello di settore ha addirittura portato a una causa legale da parte di abbonati paganti che temono di ottenere meno "valore per il loro denaro". Altri temono che un rallentamento darebbe alla Cina la possibilità di superare gli Stati Uniti in una corsa tecnologica sempre più serrata.

Ecco un'idea: perché non accelerare lo sviluppo di ambienti di test realmente isolati? Un migliore contenimento renderebbe questi test più sicuri e i loro risultati più affidabili.

Quando un bambino non è pronto a maneggiare un oggetto pericoloso, lo si tiene fuori dalla sua portata. Perché dare a un agente di intelligenza artificiale accesso a un oggetto che non è in grado di utilizzare in sicurezza?

Come utilizzare gli agenti di intelligenza artificiale in modo sicuro

Trattate un agente come un dipendente junior entusiasta ma fallibile, a cui è stato concesso l'accesso al vostro computer. Non dategli accesso illimitato alla vostra posta elettronica, ai file, allo spazio di archiviazione cloud, alle credenziali di sviluppatore, ai conti finanziari o ai sistemi di produzione solo perché promette di farvi risparmiare tempo.

Utilizza account separati con autorizzazioni minime. Mantieni, ove possibile, i dati sensibili al di fuori del contesto di lavoro, richiedi l'approvazione umana prima che l'account invii messaggi, effettui spese, modifichi le impostazioni o pubblichi qualsiasi contenuto e rivedi regolarmente la sua attività.

Un agente di intelligenza artificiale non ha bisogno di intenti malevoli per causare danni. Un'istruzione fraintesa, un'autorizzazione troppo ampia o una soluzione inaspettata possono essere sufficienti.


Dalla segnalazione delle minacce alla loro rimozione.

I rischi per la sicurezza informatica non dovrebbero mai diffondersi al di là di un titolo di giornale. Tenete le minacce lontane dai vostri dispositivi scaricando Malwarebytes oggi stesso.

Informazioni sull'autore

Pieter Arntz

Ricercatore nel campo della sicurezza informatica

È stato un MVP Microsoft per la sicurezza dei consumatori per 12 anni consecutivi. Sa parlare quattro lingue. Profuma di mogano e di libri rilegati in pelle.