OpenAI ha svelato GPT-6 Astra, una nuova generazione di modelli di intelligenza artificiale progettata per lo sviluppo software, compiti professionali complessi e l'uso autonomo dei computer. Le sue capacità in cybersecurity progrediscono notevolmente, raggiungendo per la prima volta il livello "Critical" definito dal Preparedness Framework di OpenAI.
GPT-6 Astra segna una nuova tappa nello sviluppo dei modelli OpenAI. L'azienda lo presenta come un importante passo avanti non solo per lo sviluppo software e le scienze matematiche, ma anche per l'uso professionale e l'interazione con i sistemi informatici. Il modello è specificamente progettato per eseguire compiti agentici in più fasi e intervenire negli ambienti software con maggiore autonomia.
Progresso Significativo nella Cybersecurity
La cybersecurity costituisce uno dei campi dove questa progressione è particolarmente significativa. OpenAI stima che Astra raggiunga la soglia "Critical" del suo Preparedness Framework, un traguardo mai raggiunto da precedenti modelli. Con gli strumenti e l'accesso appropriati, Astra può identificare vulnerabilità fino a non all'annuncio e sviluppare modi per sfruttarle su sistemi altamente protetti senza richiedere intervento umano in ogni singola fase. Durante una valutazione interna, il modello è stato capace di scoprire due vulnerabilità zero-day che sono state successivamente utilizzate in una catena di exploit dimostrativa.
Potenziamento delle Misure di Sicurezza da Parte di OpenAI
Queste capacità avanzatissime hanno spinto OpenAI a rafforzare significativamente le protezioni attorno al modello. L'azienda ha comunicato di aver ritardato diverse fasi del suo sviluppo e lancio per poter migliorare i suoi meccanismi contro l'uso cyber malevolo e qualsiasi azione non autorizzata. Astra integra, tra altre caratteristiche fondamentali, sistemi di rifiuti (refusals) nativi nel modello, classificatori di sicurezza avanzati, un monitoraggio costante delle sue attività e meccanismi atti a interrompere determinate operazioni considerate potenzialmente illegittime.
Inoltre, OpenAI ha evidenziato che Astra rispetta in misura maggiore i limiti espliciti di sicurezza rispetto a quanto fatto con GPT-5.6 Sol nelle sue valutazioni. Su un set di test specifico di bypass relative alla cybersecurity, Astra ha rifiutato il 91,5% delle richieste vietate, confrontandolo con il 59% registrato da GPT-5.6 Sol.
Contesto e Future Sfide dell'IA
L'azienda riconosce tuttavia che monitorare l'uso diventa intrinsecamente più difficile man mano che le capacità dei modelli avanzano. Per questo motivo, OpenAI si aspetta di implementare controlli supplementari atti a poter rallentare o interrompere anche alcuni compiti legittimi quando necessario.
L'arrivo di Astra interviene in un contesto in cui le capacità agentiche non sono solo più utili, ma anche più difficili da controllare. OpenAI prevede quindi un dispiegamento graduale del modello, mentre l'accesso alle sue funzioni di cybersicurezza più avanzate rimarrà altamente regolamentato. Greg Brockman, presidente di OpenAI, stima che questa generazione di modelli potrebbe segnare un potenziale ingresso in una nuova era dell'intelligenza artificiale generale (AGI), pur riconoscendo che la definizione stessa di AGI è ancora oggetto di interpretazione accademica e tecnica.