L’IA che inganna e si infiltra: OpenAI cancella il lancio di GPT-6.1 Astra

Chat GPT di OpenAI

IA fuori controllo. Fugge, inganna, si infiltra e porta via dati. OpenAI ha rinunciato all’imminente lancio di GPT-6.1 Astra, la sua ultima intelligenza artificiale all’avanguardia, il cui debutto era previsto per il mese di ottobre 2026.

Il modello è stato sviluppato per essere integrato in ChatGPT e Codex con l’obiettivo di gestire compiti complessi senza l’intervento umano. Ora è stato accantonato a seguito dei rischi emersi durante i test interni di allineamento e sicurezza. Secondo quanto rivelato dal Wall Street Journal e confermato da Saachi Jain, responsabile della sicurezza di OpenAI, Astra ha mostrato una “preoccupante tendenza all’inganno”. L’agente avrebbe fornito “resoconti errati” o “incompleti” sulle “azioni effettivamente intraprese”.

L’arte dell’inganno bot

Il sistema ha inoltre manifestato gravi problemi di autorizzazione dell’ambito operativo, eseguendo compiti senza richiedere il permesso dell’utente. Tentando di utilizzare strumenti o servizi esterni in contesti potenzialmente non sicuri. La decisione di bloccare il rilascio è giunta alla vigilia della conferenza annuale degli sviluppatori dell’azienda a San Francisco. Ma questo è solo l’ultimo di una serie di “incidenti” dettati da inconsuete e al momento inspiegabili uscite dai limiti imposti alla sperimentazione.

L‘infiltrazione in Australia e l’inchiesta governativa

Il congelamento del nuovo modello giunge mentre OpenAI affronta pesanti ripercussioni per una serie di incidenti di sicurezza internazionali. Il caso di maggiore gravità si è verificato in Australia, dove un agente autonomo di IA si è infiltrato tra giugno e luglio scorso all’interno del sito del ministero della Salute, accedendo indebitamente a file pubblici e non pubblici dedicati alle statistiche del sistema sanitario pubblico e alla spesa per i farmaci. L’azienda ha ammesso che i propri modelli stavano cercando dati sulle spese sanitarie per valutare le prestazioni dello strumento, intraprendendo tuttavia azioni del tutto impreviste.

L’allarme giunto in ritardo

L’episodio ha scatenato la dura reazione del primo ministro australiano Anthony Albanese, il quale ha espresso profonda delusione e preoccupazione per l’accaduto direttamente ad Altman, a margine dell’assemblea generale dell’ONU. Oggetto delle critiche è stato anche il ritardo nella notifica. OpenAI si è accorta dell’intrusione ad agosto, ma ha avvisato il governo australiano soltanto il 10 settembre. Per altro inviando un’e-mail a un indirizzo di posta generico destinato al pubblico. Il governo di Canberra ha annunciato l’avvio di un’inchiesta ufficiale per valutare possibili azioni legali contro OpenAI. Il governo australiano vuole comprendere le ragioni per cui i propri servizi di sicurezza non abbiano rilevato la violazione. Sebbene il vice primo ministro australiano Richard Marles abbia confermato che non è stato effettuato alcun accesso a dati personali, l’evento costituisce il primo caso documentato di un agente di IA che ha ottenuto un accesso non autorizzato a una rete governativa australiana.

Quanto è accaduto negli ultimi mesi getta una nuova ombra sulla potenza dell’intelligenza artificiale e sulle difficoltà del tenerla sotto controllo. Ed è probabile che alimenti ancora di più le preoccupazioni riguardo alla possibilità che i nuovi sistemi di IA, in particolare gli agenti avanzati capaci di eseguire una serie di attività senza supervisione umana, vadano oltre le intenzioni delle istruzioni ricevute.

Le interferenze negli USA

Gli incidenti non si limitano all’Australia. Durante la scorsa estate, l’IA di OpenAI è sfuggita al controllo e ha interferito all’insaputa dell’azienda con alcuni siti del governo degli Stati Uniti, tra cui il Dipartimento dell’Istruzione e la SEC, l’autorità federale indipendente del governo degli Stati Uniti che regola e vigila sui mercati finanziari.

Sebbene OpenAI abbia precisato che non si è trattato di violazioni di sicurezza in senso stretto, questi episodi testimoniano la comparsa di comportamenti imprevedibili e non controllati. In aggiunta, a seguito delle verifiche condotte dopo un attacco informatico a Hugging Face, la startup ha individuato diversi casi in cui i propri modelli hanno eluso i controlli di sicurezza di terze parti o compromesso la disponibilità di servizi online, notificando casi di disallineamento a decine di enti, governi e università. Tra le operazioni svolte “in autonomia” dall’agente IA figura anche la pubblicazione di oltre 50 immagini riservate condivise dagli utenti su ChatGPT.

Nonostante i crescenti allarmi degli esperti, Washington intende proseguire sulla via del potenziamento degli agenti IA.

Il presidente Donald Trump ha ribadito che gli Stati Uniti “non metteranno freni” allo sviluppo tecnologico, confermando la determinazione a vincere la corsa globale contro la Cina per il dominio della “superintelligenza“.

Tensioni nel settore e appelli alla prudenza

Nel frattempo, il dibattito all’interno del settore dell’intelligenza artificiale si fa sempre più acceso. Dario Amodei, numero uno di Anthropic, ha rivolto un appello globale affinché si rallenti lo sviluppo dei modelli di frontiera. Ciò per consentire alle misure di sicurezza di tenere il passo, una posizione condivisa sia da Sam Altman che da Elon Musk. Anthropic ha inserito espressi avvertimenti sui rischi dell’IA nel proprio prospetto di quotazione in Borsa. I rischi sulla sicurezza sono stati sollevati da Bill Gates e da altri autorevoli interventi nel corso del Consiglio di Sicurezza dell’ONU convocato proprio per discutere di prospettive e rischi nello sviluppo dell’IA.

Trump, intanto, ha invitato Amodei a una cena privata alla Casa Bianca dopo gli scontri tra il colosso di AI e il Pentagono per l’uso militare dei modelli di Claude. Washington aveva inserito Anthropic nella lista nera escludendola per lungo tempo da tutte le collaborazioni con il Governo. Secondo indiscrezioni, in queste ore il presidente Usa e lo speaker repubblicano della Camera Mike Johnson dovrebbero incontrare i vertici delle principali aziende di IA. Il summit avviene al termine del confronto con il presidente cinese Xi Jinping nel corso del quale si è discusso anche della corsa allo sviluppo dell’IA.