Cybersicurezza

OpenAI, sospeso addestramento modelli dopo incidenti con agenti AI. Nonostante i dubbi sbarco in Borsa confermato

L’azienda tech ha dichiarato in un comunicato che riprenderà l’addestramento “solo quando saremo certi di disporre di ulteriori misure di sicurezza”, aggiungendo che prevede di dover “mettere in pausa” nuovamente il processo man mano che l’IA si sviluppa e emergono altre problematiche

FOTO D'ARCHIVIO: Un uomo passa davanti allo stand di OpenAI al Moscone Center durante il summit tecnologico Dreamforce 2026 a San Francisco, California, Stati Uniti, il 17 settembre 2026. REUTERS/Carlos Barria/Foto d'archivio REUTERS

3' di lettura

English Version

3' di lettura

English Version

OpenAI ha dichiarato di aver sospeso l’addestramento dei suoi modelli di intelligenza artificiale più recenti, mentre si moltiplicano le segnalazioni di agenti IA che agiscono in modo autonomo e non autorizzato. La decisione di interrompere lo sviluppo è arrivata poche ore dopo che venerdì l’azienda aveva reso noto di stare esaminando diversi incidenti avvenuti durante l’estate, in cui agenti di OpenAI, mentre cercavano informazioni sui siti web del governo federale, hanno agito in modi inaspettati, andando oltre quanto loro richiesto durante la raccolta e la distribuzione delle informazioni.

Domande di approfondimento generate da 24Ore AI

Tentativi di hackeraggio a siti della Pa Usa

Da parte sua, l’organismo di valutazione dell’IA Transluce ha affermato che agenti che sembravano provenire da OpenAI hanno tentato senza successo di hackerare un sito web del Dipartimento dell’Istruzione, un dettaglio che OpenAI non ha confermato. OpenAI ha dichiarato in un comunicato che riprenderà l’addestramento “solo quando saremo certi di disporre di ulteriori misure di sicurezza”, aggiungendo che prevede di dover “mettere in pausa” nuovamente il processo man mano che l’IA si sviluppa e emergono altre problematiche. I laboratori di IA stanno subendo pressioni da parte di legislatori ed esperti del settore tecnologico affinché rallentino lo sviluppo, in modo da poter costruire misure di sicurezza per impedire agli agenti di agire autonomamente, hackerare siti web e divulgare informazioni riservate. Anche i vertici sia di OpenAI che della rivale Anthropic hanno chiesto un rallentamento.

Loading...

Indagini di OpenAI e Anthropic su migliaia di incidenti di sicurezza

In questo quadro di assoluta incertezza sull’affidabilità dell’Intelligenza artifiviale, sia OpenAI che Anthropic stanno indagando su decine di migliaia di incidenti nei quali i loro modelli di Ia più avanzati hanno compiuto azioni che valutatori esterni considerano problematiche. Lo riferisce Axios, citando proprie fonti. Gli episodi si sono verificati negli ultimi mesi sia durante test interni sia nel mondo reale. Gli incidenti comprendono aggiramento dei sistemi di sicurezza, creazione di bacheche di messaggi, fuga dalle sandbox, dirottamento di siti web, auto-prompting e tentativi di eludere i sistemi di monitoraggio, secondo le fonti citate dall’agenzia.

Episodi con diversi gradi di gravità

Molti casi non sono ancora stati resi pubblici, mentre i ricercatori continuano a indagare. Una parte dei test consiste nel cosiddetto “red-teaming”, in cui le aziende cercano deliberatamente di spingere i modelli a comportarsi in modo scorretto per verificarne la sicurezza. Gli episodi hanno livelli di gravità differenti e comprendono sia tentativi riusciti sia falliti di aggirare i sistemi di sicurezza. La maggior parte, finora, non risulta aver provocato danni nel mondo reale, mentre il numero complessivo degli incidenti potrebbe crescere ben oltre le decine di migliaia, secondo le fonti di Axios.

Tra i casi emersi recentemente ci sono agenti di OpenAI che hanno diffuso online 53 immagini appartenenti a utenti di ChatGPT, la violazione di un sito del governo australiano e tentativi di attaccare altri siti, compresi quelli del governo degli Usa, secondo quanto riferito da OpenAI, dalle fonti citate da Axios e da precedenti resoconti di Reuters e New York Times.

Per le due aziende sbarco a Wall Street ancora in calendario nonostante dubbi su AI

L’approdo di Anthropic a Wall Street è ancora previsto per questo autunno, seguito da quello di OpenAI nel 2027, anche se la volontà dei vertici di rallentare lo sviluppo dell’intelligenza artificiale (AI) e i crescenti rischi di comportamenti imprevisti dei modelli offuscano leggermente il quadro. Anthropic “rallenterà quanto necessario” il ritmo di sviluppo dell’IA “per garantire” che ogni nuovo modello immesso sul mercato “sia davvero sicuro”: è quanto ha promesso mercoledì il suo CEO, Dario Amodei, intervenendo davanti al Consiglio di Sicurezza dell’ONU.

Per alcuni, questo approccio mal si concilia con i vincoli propri di una società quotata in borsa; secondo il Wall Street Journal, infatti, circolano voci secondo cui i creatori di Claude intenderebbero compiere il grande passo a breve – più probabilmente a novembre che a ottobre, come inizialmente previsto.

Del resto, a metà settembre il Ceo di OpenAI, Sam Altman, ha ufficializzato il rinvio al 2027 della quotazione dell’azienda che ha dato vita a ChatGPT, ritenendo il 2026 una scelta infelice «alla luce di tutto ciò che sta accadendo sul fronte della sicurezza». La Borsa «aggiunge pressione» e «aspettative di crescita», oltre a comportare «una quotazione che oscilla ogni secondo», ha osservato su X Deirdre Bosa, commentatrice del settore tecnologico.

Ripercussioni dei comportamenti anomali dei modelli AI

Un altro potenziale ostacolo in vista dell’ingresso sul mercato è rappresentato dalla già ricordata serie di incidenti segnalati da Anthropic e OpenAI dall’inizio dell’estate, relativi a comportamenti anomali o imprevisti dei loro modelli.

Né Dario Amodei né Sam Altman hanno cercato di minimizzare tali episodi, che hanno visto i modelli deviare dagli obiettivi prefissati o occultare le tracce delle proprie azioni scorrette.

Loading...

Se le nuove minacce legate a questa tecnologia – ovvero l’uso malevolo o la deriva di un modello – «venissero gestite male», ha dichiarato mercoledì scorso Dario Amodei, «ritengo addirittura che l’AI potrebbe rappresentare un rischio per l’intera umanità». Anche in questo caso, gli investitori hanno mostrato perplessità, preoccupati dal possibile deterioramento dell’immagine dell’unico prodotto commercializzato dalle due aziende: l’intelligenza artificiale.

Riproduzione riservata ©
Loading...

Brand connect

Loading...

Newsletter

Notizie e approfondimenti sugli avvenimenti politici, economici e finanziari.

Iscriviti