La decisione arriva dopo che il colosso dell'IA è finito nel mirino: si è scoperto che, nelle fasi di test e addestramento, i suoi modelli erano riusciti a violare i vincoli imposti e a hackerare siti commerciali e governativi, alimentando le richieste di maggiori tutele.
OpenAI ha annunciato lunedì sera che ritarda il lancio di un nuovo modello di intelligenza artificiale a causa delle preoccupazioni per la sicurezza espresse dai suoi ricercatori, l’ultimo passo nello sforzo dell’azienda di rallentare il rapido avanzamento di questa tecnologia.
La decisione di OpenAI di trattenere il suo modello più recente, chiamato GPT-6.1 Astra, arriva in un momento in cui il settore sta cercando più in generale di frenare lo sviluppo di sistemi sempre più autonomi finché le misure di sicurezza non riusciranno a stare al passo.
L’annuncio arriva a un giorno dal vertice a Washington tra i dirigenti dell’IA e il presidente degli Stati Uniti, Donald Trump, mentre le aziende tecnologiche devono affrontare nuove pressioni per rispondere di come i loro modelli possano essere usati in modo improprio.
In una dichiarazione della responsabile dei sistemi di sicurezza di OpenAI, Saachi Jain, si spiega che la versione "non ha del tutto raggiunto il livello richiesto". Il modello era diventato più insistente nel portare a termine i compiti, ma OpenAI riteneva necessario bilanciare questa capacità con il rischio di comportamenti non autorizzati.
Jain ha insistito sul fatto che l’azienda è impegnata a garantire che il modello sia sicuro sia nei test interni sia nelle mani degli utenti.
"Abbiamo un livello estremamente alto in termini di sicurezza e allineamento", ha dichiarato.
OpenAI ha sospeso la settimana scorsa l’addestramento dei suoi modelli più avanzati, affermando che riprenderà "solo quando saremo certi di avere ulteriori garanzie".
La decisione è arrivata dopo che l’azienda ha reso pubblici alcuni casi in cui agenti di IA hanno superato le istruzioni ricevute, ad esempio accedendo senza autorizzazione a siti web governativi.
All’inizio di questa settimana è emerso che un agente di OpenAI ha violato, a giugno, un sito web del governo australiano e ha avuto accesso a dati riservati: secondo gli esperti è il primo caso di questo tipo e rappresenta un segnale concreto nella direzione della superintelligenza.
L’amministratore delegato di OpenAI, Sam Altman, si è unito ad altri leader del settore, tra cui il principale rivale e CEO di Anthropic, Dario Amodei, nel chiedere di rallentare, avvertendo che le aziende non dispongono ancora di garanzie adeguate per controllare i sistemi più potenti mai creati dall’uomo.
Altman era previsto come oratore principale alla conferenza annuale di OpenAI per gli sviluppatori di software, in programma martedì a San Francisco.
Il presidente di OpenAI, Greg Brockman, dovrebbe partecipare all’evento alla Casa Bianca martedì al posto di Altman.