OpenAi rinuncia al lancio dell’ultimo modello AI per timori sicurezza. E Anthropic nel prospetto Ipo avverte sui rischi
La startup guidata da Sam Altman avrebbe voluto lanciare Gpt-6.1 Astra nel giro di settimane ma il modello non è risultato abbastanza affidabile
2' di lettura
2' di lettura
OpenAI ha rinunciato al lancio di un nuovo modello di intelligenza artificiale (AI) all’avanguardia, ritenuto troppo incline a deviare dalle istruzioni, un ulteriore esempio della crescente difficoltà nel controllare l’AI avanzata. L’azienda non aveva precedentemente annunciato il lancio di questa versione aggiornata della sua AI, denominata GPT-6.1 Astra, previsto per ottobre, secondo quanto riportato dal Wall Street Journal. Il responsabile della sicurezza dell’AI di OpenAI, Saachi Jain, ha spiegato che, in termini di allineamento – ovvero di conformità alle istruzioni fornite dagli sviluppatori – GPT-6.1 ha mostrato prestazioni inferiori rispetto al suo predecessore, GPT-6, in due aree. Il modello tenta più frequentemente di ingannare i suoi supervisori omettendo di rivelare determinate azioni eseguite o non eseguite.
Chiedilo al Sole
OpenAI, inoltre, ha ammesso che avrebbe dovuto condividere “prima” i primi risultati delle indagini con le autorità australiane dopo che i suoi modelli di intelligenza artificiale avevano violato alcuni siti web governativi. «Il nostro obiettivo era fornire alle agenzie coinvolte un resoconto dettagliato una volta completata l’indagine», ha affermato OpenAI in un post sul blog. «Tuttavia, avremmo dovuto condividere prima i risultati preliminari e tenere aggiornate le agenzie australiane man mano che emergevano nuovi fatti».
Anthropic, intanto, ha formalmente avvertito gli investitori che la sua tecnologia potrebbe comportare rischi esistenziali per l’umanità nel tanto atteso prospetto informativo in vista delle sua quotazione. Lo riporta il Financial Times che ha preso visione del documento, in cui la startup dell’intelligenza artificiale che vale quasi 1.000 miliardi di dollari ribadisce il suo allarme sulla nuova tecnologia. Circa un terzo del suo lungo documento riporta i “fattori di rischio”, inclusa la possibilità per i modelli avanzati di manipolare e mostrare un comportamento imprevedibile. Anthropic lo scorso anno ha registrato una perdita operativa di 8 miliardi di dollari su ricavi balzati a 4,6 miliardi e spese operative di quasi 13 miliardi.



