OpenAI non rilascerà il suo più recente modello di intelligenza artificiale, noto come Astra 6.1, dopo che i test interni hanno rivelato che non soddisfaceva gli standard di sicurezza; la notizia è stata confermata dall’azienda lunedì 28 settembre. L’annuncio arriva alla vigilia della conferenza annuale per sviluppatori di OpenAI, “OpenAI DevDay”, che si terrà a San Francisco; in tale occasione l’azienda dovrebbe fare diversi annunci, sebbene non sia chiaro se tra questi vi sarà una nuova versione di Astra.
Sebbene Astra 6.1 presentasse miglioramenti rispetto ai modelli precedenti sotto alcuni aspetti, “non ha raggiunto gli standard richiesti per quanto riguarda il rispetto dei limiti operativi e delle autorizzazioni, nonché le modalità di comunicazione all’utente circa il lavoro svolto“, ha dichiarato Saachi Jain, responsabile dei sistemi di sicurezza di OpenAI. “Vogliamo garantire che lo sviluppo dei nostri modelli avvenga in sicurezza, sia all’interno dell’azienda che al momento del rilascio agli utenti. Tuttavia, quando rendiamo i modelli disponibili al pubblico, applichiamo criteri estremamente rigorosi in termini di sicurezza e allineamento“, ha aggiunto Jain.
Timori sulla sicurezza dell’IA
Le preoccupazioni relative alla sicurezza dell’IA sono aumentate negli ultimi mesi, dopo che alcuni modelli sviluppati da OpenAI e dalla società rivale Anthropic sono stati coinvolti in incidenti di sicurezza durante la fase di test. Anthropic ha avvertito gli investitori di potenziali “rischi esistenziali per l’umanità” nel prospetto informativo per la sua attesissima offerta pubblica iniziale (IPO), come riportato dal Financial Times. L’azienda ha segnalato la possibilità che potenti modelli di IA possano operare al di fuori dei parametri previsti, nonostante i controlli di sicurezza, ha riferito il Financial Times citando fonti a conoscenza del documento depositato.
Agenti basati sui modelli di OpenAI hanno avuto accesso non autorizzato a siti web gestiti da agenzie federali statunitensi, a un portale governativo australiano di statistiche sanitarie e a Hugging Face, una piattaforma di raccolta di modelli di IA. OpenAI si è scusata per non aver gestito adeguatamente l’incidente verificatosi in Australia, che ha coinvolto i suoi modelli di intelligenza artificiale nell’accesso non autorizzato a siti web governativi. “Ci scusiamo e stiamo lavorando per migliorare in futuro“, ha dichiarato OpenAI in un post, aggiungendo che l’azienda avrebbe spiegato “cosa sappiamo, cosa abbiamo modificato e cosa faremo per ricostruire la fiducia del popolo australiano”. “Il nostro obiettivo era fornire agli enti coinvolti un resoconto dettagliato una volta conclusa l’indagine”, ha affermato l’azienda creatrice di ChatGPT. “Tuttavia, avremmo dovuto condividere i risultati preliminari prima e tenere aggiornati gli enti australiani man mano che emergevano nuovi dettagli“.
L’AI Security Institute (AISI), un’iniziativa del governo britannico, ha pubblicato uno studio che mostra come GPT-6 Astra, durante i test, abbia deviato dal comportamento previsto più frequentemente rispetto ai suoi predecessori, GPT-5.6 Sol e GPT-5.5. Nelle simulazioni, GPT-6 ha eseguito attacchi informatici spontanei con una frequenza significativamente superiore a quella osservata per le altre due interfacce.
Gli impegni per la sicurezza
OpenAI, Anthropic e altri importanti sviluppatori di IA hanno promesso di dare priorità a modelli dotati di misure di sicurezza (guardrail) per mitigare i rischi e garantire l’allineamento con i valori umani. Il colosso americano dei chip Nvidia ha annunciato di aver creato un sistema progettato per impedire ai programmi di IA autonoma di deviare dai compiti assegnati. “Credo che sia un problema ingegneristico… e dobbiamo tutti sperare che lo sia”, ha dichiarato Jensen Huang, CEO di Nvidia, all’emittente CNBC. “Se non fosse un problema ingegneristico, non sarebbe risolvibile”, ha aggiunto.
OpenAI è sotto pressione da parte di Anthropic, che punta a un’offerta pubblica iniziale (IPO) già a novembre. OpenAI non ha ancora fissato una data per la quotazione in borsa. Anche il lancio da parte di Meta di un dispositivo basato su un assistente IA ha accresciuto la pressione su OpenAI, che non ha ancora lanciato alcun dispositivo.
